Anbeeld commited on
Commit
501cf33
·
verified ·
1 Parent(s): c971c52

Add GLM5.3 Flash DFlash2 GGUF quantizations

Browse files
.gitattributes CHANGED
@@ -33,3 +33,10 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
 
 
 
 
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ GLM-5.3-Flash-DFlash2-bf16.gguf filter=lfs diff=lfs merge=lfs -text
37
+ GLM-5.3-Flash-DFlash2-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
38
+ GLM-5.3-Flash-DFlash2-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
39
+ GLM-5.3-Flash-DFlash2-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
40
+ GLM-5.3-Flash-DFlash2-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
41
+ GLM-5.3-Flash-DFlash2-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
42
+ GLM-5.3-Flash-DFlash2-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
GLM-5.3-Flash-DFlash2-Q2_K.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:571463bc3d2d59cc28c1ba02f1e35ac08b79a47fa07dda06376247217f31597b
3
+ size 433474464
GLM-5.3-Flash-DFlash2-Q3_K_M.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:2d6d50e5638d0d2f4ceac92d91e4c25ce62fe1465f8713cd6d3ad421da30f3af
3
+ size 561794976
GLM-5.3-Flash-DFlash2-Q4_K_M.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f4158ffb805b26c4fe439669c2009908a80ea89e1576ecea4d03eaded18f017c
3
+ size 697017248
GLM-5.3-Flash-DFlash2-Q5_K_M.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:51d38d51e05b1184b40f3ee026dcff3fe33b72f37b6f1c198f34441f85a0f929
3
+ size 829744032
GLM-5.3-Flash-DFlash2-Q6_K.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f399c8641195046502ed77c676edeec9e716d1968414e1fef11e95dd0a6c6bec
3
+ size 970766240
GLM-5.3-Flash-DFlash2-Q8_0.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0af40871f001e624ea0fb766495405bf0d68232435a63cb00ced97e77a4387aa
3
+ size 1254335392
GLM-5.3-Flash-DFlash2-bf16.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d4817916e38716dc11e482f7937af6502fd1b321e3836944b61b689b450fbb2a
3
+ size 2352022432
README.md ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ base_model: incoai/GLM-5.3-Flash-DFlash2
3
+ tags:
4
+ - transformers
5
+ - safetensors
6
+ - qwen3
7
+ - dflash
8
+ - dflash2
9
+ - speculative-decoding
10
+ - block-diffusion
11
+ - draft-model
12
+ - sglang
13
+ - text-generation
14
+ - base_model:zai-org/GLM-5.3-Flash
15
+ - base_model:finetune:zai-org/GLM-5.3-Flash
16
+ - license:cc-by-nc-nd-4.0
17
+ - text-generation-inference
18
+ - region:us
19
+ ---
20
+
21
+ **GLM 5.3 Flash DFlash2 GGUF**
22
+
23
+ llama.cpp quantizations of [**Inco AI DFlash2 draft model**](https://huggingface.co/incoai/GLM-5.3-Flash-DFlash2) for [**GLM 5.3 Flash**](https://huggingface.co/zai-org/GLM-5.3-Flash).