Commit History

Serve base Nemotron 3 Nano without LoRA
7f28039
verified

sayshara commited on

Fix startup script and enable fast warmup
bdae862
verified

sayshara commited on

Use CUDA llama.cpp server image
d22f307
verified

sayshara commited on

Download GGUF at runtime
1bd77b1
verified

sayshara commited on

Add llama.cpp GGUF Docker Space
2083edb
verified

sayshara commited on