How to use from the
Use from the
Transformers library
# Use a pipeline as a high-level helper
from transformers import pipeline

pipe = pipeline("image-text-to-text", model="ApocalypseParty/G4-31B-configSC")
# Load model directly
from transformers import AutoProcessor, AutoModelForMultimodalLM

processor = AutoProcessor.from_pretrained("ApocalypseParty/G4-31B-configSC")
model = AutoModelForMultimodalLM.from_pretrained("ApocalypseParty/G4-31B-configSC", device_map="auto")
Quick Links

G4-31B-configSC

This is a merge of pre-trained language models created using mergekit.

Merge Details

Merge Method

This model was merged using the Linear DELLA merge method using google/gemma-4-31B-it as a base.

Models Merged

The following models were included in the merge:

Configuration

The following YAML configuration was used to produce this model:

merge_method: della_linear
base_model: google/gemma-4-31B-it
dtype: bfloat16
parameters:
  lambda: 1.0
  normalize: false
  rescale: false
  density: 1.0
models:
  - model: ApocalypseParty/G4-31B-SFT-Diversity-1-5ep
    parameters:
      weight:
        - filter: vision_tower
          value: 0.0
        - filter: embed_vision
          value: 0.0
        - filter: model.language_model.layers.0.
          value: 0.0
        - filter: model.language_model.layers.1.
          value: 0.0
        - filter: model.language_model.layers.2.
          value: 0.0
        - filter: model.language_model.layers.3.
          value: 0.0
        - filter: model.language_model.layers.4.
          value: 0.0
        - filter: model.language_model.layers.5.
          value: 0.0
        - filter: model.language_model.layers.6.
          value: 0.0
        - filter: model.language_model.layers.7.
          value: 0.0
        - filter: model.language_model.layers.8.
          value: 0.0
        - filter: model.language_model.layers.9.
          value: 0.0
        - filter: model.language_model.layers.10.
          value: 0.0
        - filter: model.language_model.layers.11.
          value: 0.0
        - filter: model.language_model.layers.12.
          value: 0.0
        - filter: model.language_model.layers.13.
          value: 0.0
        - filter: model.language_model.layers.14.
          value: 0.0
        - filter: model.language_model.layers.15.
          value: 0.0
        - filter: model.language_model.layers.16.
          value: 0.0
        - filter: model.language_model.layers.17.
          value: 0.0
        - filter: model.language_model.layers.18.
          value: 0.0
        - filter: model.language_model.layers.19.
          value: 0.0
        - filter: model.language_model.layers.20.
          value: 0.0
        - filter: model.language_model.layers.21.
          value: 0.0
        - filter: model.language_model.layers.22.
          value: 0.0
        - filter: model.language_model.layers.23.
          value: 0.0
        - filter: model.language_model.layers.24.
          value: 0.0
        - filter: model.language_model.layers.25.
          value: 0.0
        - filter: mlp.
          value: 1.0
        - filter: self_attn
          value: 0.3
        - value: 0.0
  - model: zerofata/G4-MeroMero-31B
    parameters:
      weight:
        - filter: vision_tower
          value: 0.0
        - filter: embed_vision
          value: 0.0
        - filter: model.language_model.layers.0.
          value: 1.0
        - filter: model.language_model.layers.1.
          value: 1.0
        - filter: model.language_model.layers.2.
          value: 1.0
        - filter: model.language_model.layers.3.
          value: 1.0
        - filter: model.language_model.layers.4.
          value: 1.0
        - filter: model.language_model.layers.5.
          value: 1.0
        - filter: model.language_model.layers.6.
          value: 1.0
        - filter: model.language_model.layers.7.
          value: 1.0
        - filter: model.language_model.layers.8.
          value: 1.0
        - filter: model.language_model.layers.9.
          value: 1.0
        - filter: model.language_model.layers.10.
          value: 1.0
        - filter: model.language_model.layers.11.
          value: 1.0
        - filter: model.language_model.layers.12.
          value: 1.0
        - filter: model.language_model.layers.13.
          value: 1.0
        - filter: model.language_model.layers.14.
          value: 1.0
        - filter: model.language_model.layers.15.
          value: 1.0
        - filter: model.language_model.layers.16.
          value: 1.0
        - filter: model.language_model.layers.17.
          value: 1.0
        - filter: model.language_model.layers.18.
          value: 1.0
        - filter: model.language_model.layers.19.
          value: 1.0
        - filter: model.language_model.layers.20.
          value: 1.0
        - filter: model.language_model.layers.21.
          value: 1.0
        - filter: model.language_model.layers.22.
          value: 1.0
        - filter: model.language_model.layers.23.
          value: 1.0
        - filter: model.language_model.layers.24.
          value: 1.0
        - filter: model.language_model.layers.25.
          value: 1.0
        - filter: self_attn
          value: 1.0
        - value: 0.0
Downloads last month
12
Safetensors
Model size
31B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for ApocalypseParty/G4-31B-configSC

Paper for ApocalypseParty/G4-31B-configSC