EXL3 quantization of Gemma-4-26B-A4B-StyleTune-V2, 4 bits per weight.
Use CPU offloading by setting EXL3_MOE_CPU_OFFLOAD.
E.g. with TabbyAPI:
EXL3_MOE_CPU_OFFLOAD=10 python main.py ...
- Downloads last month
- 20
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support
Model tree for isogen/Gemma-4-26B-A4B-StyleTune-V2-exl3-4bpw
Base model
google/gemma-4-26B-A4B Finetuned
google/gemma-4-26B-A4B-it Finetuned
Gryphe/Gemma-4-26B-A4B-StyleTune-V2