llama-2-13b-rlmpq-high-fidelity / rlmpq_policy.json
AvoCahDoe's picture
RL-MPQ High Fidelity — 2026-06-11T18:51:39.213945
671f392 verified
Raw
History Blame
1.09 kB
{
"slug": "llama_2_13b",
"hf_id": "meta-llama/Llama-2-13b-hf",
"scenario": "High_Fidelity",
"params": {
"lambda_mse": 1.0,
"lambda_bit": 0.05,
"max_mse_clip": 1.0,
"target_bits": 7.0,
"lambda_budget": 2.0
},
"policy": [
4,
4,
4,
4,
4,
4,
4,
4,
4,
4,
4,
4,
4,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8,
8
],
"num_layers": 40,
"avg_bits": 6.7,
"total_reward": -1.984871,
"compression_ratio": 2.3881,
"approx_size_gb": 10.887,
"bit_distribution": {
"4": 13,
"8": 27
},
"avg_mse_per_bit": {
"4": 0.43101077,
"8": 0.00013292
},
"validation_elapsed_s": 0.0131,
"policy_source": "/workspace/RL-NMP-Model-Quantasation/phase3/models/llama_2_13b/results/High_Fidelity_policy.json",
"policy_path": "/workspace/RL-NMP-Model-Quantasation/phase3/models/llama_2_13b/results/High_Fidelity_policy.json",
"training_run": "20260610_202902"
}