Fix MTP ignore names for SGLang fused Linear layers (`qkv_proj` / `gate_up_proj`)

#9
by dived42 - opened
Files changed (1) hide show
  1. config.json +3 -1
config.json CHANGED
@@ -342,10 +342,12 @@
342
  "mtp.layers.0.mlp.down_proj",
343
  "mtp.layers.0.mlp.gate_proj",
344
  "mtp.layers.0.mlp.up_proj",
 
345
  "mtp.layers.0.self_attn.k_proj",
346
  "mtp.layers.0.self_attn.o_proj",
347
  "mtp.layers.0.self_attn.q_proj",
348
- "mtp.layers.0.self_attn.v_proj"
 
349
  ],
350
  "kv_cache_scheme": null,
351
  "quant_method": "compressed-tensors",
 
342
  "mtp.layers.0.mlp.down_proj",
343
  "mtp.layers.0.mlp.gate_proj",
344
  "mtp.layers.0.mlp.up_proj",
345
+ "mtp.layers.0.mlp.gate_up_proj",
346
  "mtp.layers.0.self_attn.k_proj",
347
  "mtp.layers.0.self_attn.o_proj",
348
  "mtp.layers.0.self_attn.q_proj",
349
+ "mtp.layers.0.self_attn.v_proj",
350
+ "mtp.layers.0.self_attn.qkv_proj"
351
  ],
352
  "kv_cache_scheme": null,
353
  "quant_method": "compressed-tensors",