{ "lineage": { "original_model_family": "google/gemma-4-26B-A4B-it", "qat_parent_lineage": "google/gemma-4-26B-A4B-it-qat-q4_0-unquantized", "immediate_quantization_parent": "Mitchins/gemma-4-26B-A4B-it-qat-q4_0-unquantized-uncensored-heretic", "immediate_parent_revision": "d62fa836581401beafd08fdd624927e31dcac6ee", "immediate_parent_relation": "QAT/Heretic tuned and uncensored derivative; this W4A16 artifact quantizes that parent, not stock Google IT weights.", "license": "Apache-2.0 inherited from the parent" }, "source_file_sha256": { "model-00001-of-00011.safetensors": "0a8ef8c2e3a967601b62b2bd052f9327c5e80d844bff495cdabba0a32c988fd9", "model-00002-of-00011.safetensors": "b643e01d2a56cffd216f4cb4025bf312142af46127a3f3701fe1548758edfdfe", "model-00003-of-00011.safetensors": "724dd311e180744593e7cff6dc4a3dbd51cccf39c3fe23e8589121f7a125576e", "model-00004-of-00011.safetensors": "01e459f49f7b5c7dfa9f4fba53a78af0f9978ca49b56b0404008116a6b171abf", "model-00005-of-00011.safetensors": "e800b4e729edc6f54672006150ad9bcec046b0b5b2d620cabe277242b52acaab", "model-00006-of-00011.safetensors": "0a90f287557e40ebedee1d595035b760642217c8960f8cf1b494034c6d4cee86", "model-00007-of-00011.safetensors": "3b796785e6f9f67d74d75facaf1ec95651d3409def2c67afc1a3b4237a9f544b", "model-00008-of-00011.safetensors": "5dd1bf454448f1e1f7f58e68eb4908b557d89e6cfd04cc13731b490635dc64e6", "model-00009-of-00011.safetensors": "1887636919fe8d0326964a3645a867bbe9ecf8c4c9202c2a8d2927cfa2725b46", "model-00010-of-00011.safetensors": "36498727d58f158cb29e7d93dbbf457bf8fb0e883859888f6db2cd3f5fe585b2", "model-00011-of-00011.safetensors": "33918a3f3e04864eba494e5515fd9b0575c2a923d0cf080d12b6fb922d41bbeb", "config.json": "fb61827d95f23593a13dbc03023ac4892f31495b0348f2f5ef9a720c7568f772", "generation_config.json": "4985d1a588cdbd922d99c3ccad042b0493773a499937fa248d5849ef4afb4101", "model.safetensors.index.json": "1e9e4718c49193ff47e2ca0847dfad3cfa5e57e6799463994284fc3284f93c7d", "processor_config.json": "32bdf45d2ad4cc29a0822ddd157a182de76644f0419a6228d151495256e9813c", "tokenizer.json": "cc8d3a0ce36466ccc1278bf987df5f71db1719b9ca6b4118264f45cb627bfe0f", "tokenizer_config.json": "b8045a4576903e86903291d5cbdd4adfc8859e9ce3c98621bdbd957f73ed394b", "chat_template.jinja": "ae53464bf3be25802b3a5b37def7fd89667067d7577049b3b2d74c4d8de4c6d4" }, "source_architecture": { "model_type": "gemma4", "architectures": [ "Gemma4ForConditionalGeneration" ], "text_max_position_embeddings": 262144, "intermediate_size": 2112, "moe_intermediate_size": 704 }, "calibration": { "seed": 20260812, "text_windows": 512, "tokens_per_text_window": 512, "image_samples": 1024, "image_source": "COCO 2017 validation", "source_urls": [ "https://s3.amazonaws.com/images.cocodataset.org/zips/val2017.zip", "https://s3.amazonaws.com/images.cocodataset.org/annotations/annotations_trainval2017.zip" ], "text_sources": [ { "dataset": "Salesforce/wikitext", "config": "wikitext-103-raw-v1", "count": 192 }, { "dataset": "HuggingFaceTB/smoltalk", "config": "openhermes-100k", "count": 192 }, { "dataset": "HuggingFaceTB/smoltalk", "config": "apigen-80k", "count": 128 } ] }, "quantization_run": { "weight_bits": 4, "activation_bits": 16, "group_size": 64, "algorithm": "GPTQ", "pipeline": "sequential", "max_seq_length": 1024, "moe_calibrate_all_experts": true, "ignore": [ "re:.*lm_head$", "re:.*vision_tower.*", "re:.*router.*", "re:.*embed_tokens.*", "re:.*embed_vision.*" ], "sample_layout": "first 512 image+text, remaining 512 image-instruction", "limit_mm_per_prompt": { "image": 1, "video": 0 } }, "conversion_recipe": { "config_groups": { "group_0": { "format": "pack-quantized", "input_activations": null, "output_activations": null, "targets": [ "Linear" ], "weights": { "actorder": "static", "block_structure": null, "dynamic": false, "group_size": 64, "num_bits": 4, "observer": "memoryless_minmax", "observer_kwargs": {}, "scale_dtype": null, "strategy": "group", "symmetric": true, "type": "int", "zp_dtype": null } } }, "format": "pack-quantized", "global_compression_ratio": null, "ignore": [ "model.vision_tower.patch_embedder.input_proj", "model.vision_tower.encoder.layers.0.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.0.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.0.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.0.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.0.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.0.mlp.up_proj.linear", "model.vision_tower.encoder.layers.0.mlp.down_proj.linear", "model.vision_tower.encoder.layers.1.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.1.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.1.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.1.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.1.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.1.mlp.up_proj.linear", "model.vision_tower.encoder.layers.1.mlp.down_proj.linear", "model.vision_tower.encoder.layers.2.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.2.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.2.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.2.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.2.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.2.mlp.up_proj.linear", "model.vision_tower.encoder.layers.2.mlp.down_proj.linear", "model.vision_tower.encoder.layers.3.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.3.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.3.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.3.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.3.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.3.mlp.up_proj.linear", "model.vision_tower.encoder.layers.3.mlp.down_proj.linear", "model.vision_tower.encoder.layers.4.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.4.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.4.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.4.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.4.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.4.mlp.up_proj.linear", "model.vision_tower.encoder.layers.4.mlp.down_proj.linear", "model.vision_tower.encoder.layers.5.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.5.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.5.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.5.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.5.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.5.mlp.up_proj.linear", "model.vision_tower.encoder.layers.5.mlp.down_proj.linear", "model.vision_tower.encoder.layers.6.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.6.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.6.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.6.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.6.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.6.mlp.up_proj.linear", "model.vision_tower.encoder.layers.6.mlp.down_proj.linear", "model.vision_tower.encoder.layers.7.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.7.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.7.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.7.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.7.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.7.mlp.up_proj.linear", "model.vision_tower.encoder.layers.7.mlp.down_proj.linear", "model.vision_tower.encoder.layers.8.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.8.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.8.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.8.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.8.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.8.mlp.up_proj.linear", "model.vision_tower.encoder.layers.8.mlp.down_proj.linear", "model.vision_tower.encoder.layers.9.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.9.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.9.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.9.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.9.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.9.mlp.up_proj.linear", "model.vision_tower.encoder.layers.9.mlp.down_proj.linear", "model.vision_tower.encoder.layers.10.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.10.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.10.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.10.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.10.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.10.mlp.up_proj.linear", "model.vision_tower.encoder.layers.10.mlp.down_proj.linear", "model.vision_tower.encoder.layers.11.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.11.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.11.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.11.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.11.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.11.mlp.up_proj.linear", "model.vision_tower.encoder.layers.11.mlp.down_proj.linear", "model.vision_tower.encoder.layers.12.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.12.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.12.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.12.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.12.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.12.mlp.up_proj.linear", "model.vision_tower.encoder.layers.12.mlp.down_proj.linear", "model.vision_tower.encoder.layers.13.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.13.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.13.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.13.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.13.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.13.mlp.up_proj.linear", "model.vision_tower.encoder.layers.13.mlp.down_proj.linear", "model.vision_tower.encoder.layers.14.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.14.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.14.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.14.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.14.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.14.mlp.up_proj.linear", "model.vision_tower.encoder.layers.14.mlp.down_proj.linear", "model.vision_tower.encoder.layers.15.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.15.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.15.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.15.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.15.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.15.mlp.up_proj.linear", "model.vision_tower.encoder.layers.15.mlp.down_proj.linear", "model.vision_tower.encoder.layers.16.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.16.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.16.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.16.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.16.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.16.mlp.up_proj.linear", "model.vision_tower.encoder.layers.16.mlp.down_proj.linear", "model.vision_tower.encoder.layers.17.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.17.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.17.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.17.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.17.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.17.mlp.up_proj.linear", "model.vision_tower.encoder.layers.17.mlp.down_proj.linear", "model.vision_tower.encoder.layers.18.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.18.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.18.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.18.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.18.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.18.mlp.up_proj.linear", "model.vision_tower.encoder.layers.18.mlp.down_proj.linear", "model.vision_tower.encoder.layers.19.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.19.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.19.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.19.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.19.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.19.mlp.up_proj.linear", "model.vision_tower.encoder.layers.19.mlp.down_proj.linear", "model.vision_tower.encoder.layers.20.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.20.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.20.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.20.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.20.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.20.mlp.up_proj.linear", "model.vision_tower.encoder.layers.20.mlp.down_proj.linear", "model.vision_tower.encoder.layers.21.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.21.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.21.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.21.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.21.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.21.mlp.up_proj.linear", "model.vision_tower.encoder.layers.21.mlp.down_proj.linear", "model.vision_tower.encoder.layers.22.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.22.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.22.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.22.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.22.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.22.mlp.up_proj.linear", "model.vision_tower.encoder.layers.22.mlp.down_proj.linear", "model.vision_tower.encoder.layers.23.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.23.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.23.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.23.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.23.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.23.mlp.up_proj.linear", "model.vision_tower.encoder.layers.23.mlp.down_proj.linear", "model.vision_tower.encoder.layers.24.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.24.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.24.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.24.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.24.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.24.mlp.up_proj.linear", "model.vision_tower.encoder.layers.24.mlp.down_proj.linear", "model.vision_tower.encoder.layers.25.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.25.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.25.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.25.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.25.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.25.mlp.up_proj.linear", "model.vision_tower.encoder.layers.25.mlp.down_proj.linear", "model.vision_tower.encoder.layers.26.self_attn.q_proj.linear", "model.vision_tower.encoder.layers.26.self_attn.k_proj.linear", "model.vision_tower.encoder.layers.26.self_attn.v_proj.linear", "model.vision_tower.encoder.layers.26.self_attn.o_proj.linear", "model.vision_tower.encoder.layers.26.mlp.gate_proj.linear", "model.vision_tower.encoder.layers.26.mlp.up_proj.linear", "model.vision_tower.encoder.layers.26.mlp.down_proj.linear", "model.language_model.layers.0.router", "model.language_model.layers.0.router.proj", "model.language_model.layers.1.router", "model.language_model.layers.1.router.proj", "model.language_model.layers.2.router", "model.language_model.layers.2.router.proj", "model.language_model.layers.3.router", "model.language_model.layers.3.router.proj", "model.language_model.layers.4.router", "model.language_model.layers.4.router.proj", "model.language_model.layers.5.router", "model.language_model.layers.5.router.proj", "model.language_model.layers.6.router", "model.language_model.layers.6.router.proj", "model.language_model.layers.7.router", "model.language_model.layers.7.router.proj", "model.language_model.layers.8.router", "model.language_model.layers.8.router.proj", "model.language_model.layers.9.router", "model.language_model.layers.9.router.proj", "model.language_model.layers.10.router", "model.language_model.layers.10.router.proj", "model.language_model.layers.11.router", "model.language_model.layers.11.router.proj", "model.language_model.layers.12.router", "model.language_model.layers.12.router.proj", "model.language_model.layers.13.router", "model.language_model.layers.13.router.proj", "model.language_model.layers.14.router", "model.language_model.layers.14.router.proj", "model.language_model.layers.15.router", "model.language_model.layers.15.router.proj", "model.language_model.layers.16.router", "model.language_model.layers.16.router.proj", "model.language_model.layers.17.router", "model.language_model.layers.17.router.proj", "model.language_model.layers.18.router", "model.language_model.layers.18.router.proj", "model.language_model.layers.19.router", "model.language_model.layers.19.router.proj", "model.language_model.layers.20.router", "model.language_model.layers.20.router.proj", "model.language_model.layers.21.router", "model.language_model.layers.21.router.proj", "model.language_model.layers.22.router", "model.language_model.layers.22.router.proj", "model.language_model.layers.23.router", "model.language_model.layers.23.router.proj", "model.language_model.layers.24.router", "model.language_model.layers.24.router.proj", "model.language_model.layers.25.router", "model.language_model.layers.25.router.proj", "model.language_model.layers.26.router", "model.language_model.layers.26.router.proj", "model.language_model.layers.27.router", "model.language_model.layers.27.router.proj", "model.language_model.layers.28.router", "model.language_model.layers.28.router.proj", "model.language_model.layers.29.router", "model.language_model.layers.29.router.proj", "model.embed_vision.embedding_projection", "lm_head" ], "kv_cache_scheme": null, "quant_method": "compressed-tensors", "quantization_status": "compressed", "sparsity_config": {}, "transform_config": {}, "version": "0.18.0" }, "software": { "conversion_artifact_compressed_tensors_version": "0.18.0", "validated_vllm_commit": "7ca49fbe4bab019e55d57cdc4b7fd3d55c67c1a6", "validated_transformers": "5.15.1", "validated_pytorch": "2.13.0+cu130", "validated_cuda_runtime": "13.0", "validated_compressed_tensors_runtime": "0.17.0" } }