Text Generation
MLX
Safetensors
qwen3_5_mtp
qwen3.8
multi-token-prediction
speculative-decoding
qwen3_5
apple-silicon
4-bit precision
Instructions to use junafinity/qwen38-mtp-head-fc-bf16-4bit with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- MLX
How to use junafinity/qwen38-mtp-head-fc-bf16-4bit with MLX:
# Make sure mlx-lm is installed # pip install --upgrade mlx-lm # if on a CUDA device, also pip install mlx[cuda] # Generate text with mlx-lm from mlx_lm import load, generate model, tokenizer = load("junafinity/qwen38-mtp-head-fc-bf16-4bit") prompt = "Once upon a time in" text = generate(model, tokenizer, prompt=prompt, verbose=True) - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- LM Studio
- MLX LM
How to use junafinity/qwen38-mtp-head-fc-bf16-4bit with MLX LM:
Generate or start a chat session
# Install MLX LM uv tool install mlx-lm # Generate some text mlx_lm.generate --model "junafinity/qwen38-mtp-head-fc-bf16-4bit" --prompt "Once upon a time"
- Atomic Chat
| { | |
| "metadata": { | |
| "total_size": 314297344 | |
| }, | |
| "weight_map": { | |
| "fc.weight": "model.safetensors", | |
| "layers.0.input_layernorm.weight": "model.safetensors", | |
| "layers.0.mlp.down_proj.biases": "model.safetensors", | |
| "layers.0.mlp.down_proj.scales": "model.safetensors", | |
| "layers.0.mlp.down_proj.weight": "model.safetensors", | |
| "layers.0.mlp.gate_proj.biases": "model.safetensors", | |
| "layers.0.mlp.gate_proj.scales": "model.safetensors", | |
| "layers.0.mlp.gate_proj.weight": "model.safetensors", | |
| "layers.0.mlp.up_proj.biases": "model.safetensors", | |
| "layers.0.mlp.up_proj.scales": "model.safetensors", | |
| "layers.0.mlp.up_proj.weight": "model.safetensors", | |
| "layers.0.post_attention_layernorm.weight": "model.safetensors", | |
| "layers.0.self_attn.k_norm.weight": "model.safetensors", | |
| "layers.0.self_attn.k_proj.biases": "model.safetensors", | |
| "layers.0.self_attn.k_proj.scales": "model.safetensors", | |
| "layers.0.self_attn.k_proj.weight": "model.safetensors", | |
| "layers.0.self_attn.o_proj.biases": "model.safetensors", | |
| "layers.0.self_attn.o_proj.scales": "model.safetensors", | |
| "layers.0.self_attn.o_proj.weight": "model.safetensors", | |
| "layers.0.self_attn.q_norm.weight": "model.safetensors", | |
| "layers.0.self_attn.q_proj.biases": "model.safetensors", | |
| "layers.0.self_attn.q_proj.scales": "model.safetensors", | |
| "layers.0.self_attn.q_proj.weight": "model.safetensors", | |
| "layers.0.self_attn.v_proj.biases": "model.safetensors", | |
| "layers.0.self_attn.v_proj.scales": "model.safetensors", | |
| "layers.0.self_attn.v_proj.weight": "model.safetensors", | |
| "norm.weight": "model.safetensors", | |
| "pre_fc_norm_embedding.weight": "model.safetensors", | |
| "pre_fc_norm_hidden.weight": "model.safetensors" | |
| } | |
| } |