lsm0729's picture
Upload W8A8 quantized Qwen2.5-VL-3B-Instruct model
f50cc4e verified
Raw
History Blame Contribute Delete
259 Bytes
default_stage:
default_modifiers:
GPTQModifier:
targets: [Linear]
ignore: [lm_head, 're:visual.*', 're:model.visual.*']
scheme: W8A8
block_size: 128
dampening_frac: 0.01
actorder: static
offload_hessians: false