Mellum2.1-12B-A2.5B-Thinking-FP8 / tokenizer_config.json
PY-AI-Dev's picture
Add FP8 (dynamic) quantization for Mellum2.1-12B-A2.5B-Thinking
fb00258 verified
Raw History Blame Contribute Delete
318 Bytes
{
"backend": "tokenizers",
"bos_token": "<|endoftext|>",
"clean_up_tokenization_spaces": false,
"eos_token": "<|im_end|>",
"is_local": false,
"local_files_only": false,
"model_max_length": 131072,
"pad_token": "<|endoftext|>",
"tokenizer_class": "TokenizersBackend",
"unk_token": "<|endoftext|>"
}