JoshuaWong commited on
Commit
2430e6e
·
verified ·
1 Parent(s): 851bc3d

Upload folder using huggingface_hub

Browse files
Files changed (6) hide show
  1. .msc +0 -0
  2. .mv +1 -1
  3. config.json +7 -3
  4. generation_config.json +1 -2
  5. model.safetensors +1 -1
  6. recipe.yaml +6 -0
.msc CHANGED
Binary files a/.msc and b/.msc differ
 
.mv CHANGED
@@ -1 +1 @@
1
- Revision:master,CreatedAt:1754460938
 
1
+ Revision:master,CreatedAt:1755062608
config.json CHANGED
@@ -3,6 +3,7 @@
3
  "Qwen2_5_VLForConditionalGeneration"
4
  ],
5
  "attention_dropout": 0.0,
 
6
  "eos_token_id": 151645,
7
  "hidden_act": "silu",
8
  "hidden_size": 2048,
@@ -15,7 +16,6 @@
15
  "num_attention_heads": 16,
16
  "num_hidden_layers": 36,
17
  "num_key_value_heads": 2,
18
- "pad_token_id": 151654,
19
  "quantization_config": {
20
  "config_groups": {
21
  "group_0": {
@@ -207,7 +207,12 @@
207
  ],
208
  "kv_cache_scheme": null,
209
  "quant_method": "compressed-tensors",
210
- "quantization_status": "compressed"
 
 
 
 
 
211
  },
212
  "rms_norm_eps": 1e-06,
213
  "rope_scaling": {
@@ -263,7 +268,6 @@
263
  },
264
  "torch_dtype": "bfloat16",
265
  "transformers_version": "4.52.4",
266
- "unsloth_fixed": true,
267
  "use_cache": true,
268
  "use_sliding_window": false,
269
  "video_token_id": 151656,
 
3
  "Qwen2_5_VLForConditionalGeneration"
4
  ],
5
  "attention_dropout": 0.0,
6
+ "bos_token_id": 151643,
7
  "eos_token_id": 151645,
8
  "hidden_act": "silu",
9
  "hidden_size": 2048,
 
16
  "num_attention_heads": 16,
17
  "num_hidden_layers": 36,
18
  "num_key_value_heads": 2,
 
19
  "quantization_config": {
20
  "config_groups": {
21
  "group_0": {
 
207
  ],
208
  "kv_cache_scheme": null,
209
  "quant_method": "compressed-tensors",
210
+ "quantization_status": "compressed",
211
+ "bits": 4,
212
+ "group_size": 128,
213
+ "quant_method": "awq",
214
+ "version": "gemm",
215
+ "zero_point": true
216
  },
217
  "rms_norm_eps": 1e-06,
218
  "rope_scaling": {
 
268
  },
269
  "torch_dtype": "bfloat16",
270
  "transformers_version": "4.52.4",
 
271
  "use_cache": true,
272
  "use_sliding_window": false,
273
  "video_token_id": 151656,
generation_config.json CHANGED
@@ -5,8 +5,7 @@
5
  151645,
6
  151643
7
  ],
8
- "max_length": 128000,
9
- "pad_token_id": 151654,
10
  "repetition_penalty": 1.05,
11
  "temperature": 1e-06,
12
  "transformers_version": "4.52.4"
 
5
  151645,
6
  151643
7
  ],
8
+ "pad_token_id": 151643,
 
9
  "repetition_penalty": 1.05,
10
  "temperature": 1e-06,
11
  "transformers_version": "4.52.4"
model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:f65f3268ec0558c314408747fd87e1f9b51373c2743ed46deeb117c89793d97e
3
  size 4024151208
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1eaa4f6b735db4f9aad9d1bfab7f027476780c1162da9291e1e412d9d57b936f
3
  size 4024151208
recipe.yaml ADDED
@@ -0,0 +1,6 @@
 
 
 
 
 
 
 
1
+ default_stage:
2
+ default_modifiers:
3
+ AWQModifier:
4
+ targets: [Linear]
5
+ ignore: [lm_head, 're:visual.*', 're:model.visual.*']
6
+ scheme: W4A16_ASYM