Commit History

docs: add fidelity/batch-scaling data, MTP guidance and provenance
1e67b67
verified

julianmb commited on

docs: update server references to HaloFPX (julianmb/halofpx)
7165910
verified

julianmb commited on

docs: add sustained MTP (K=4) benchmark and optional NPU hybrid TTFT section (Qwen 3.8 only)
68fcfb5
verified

julianmb commited on

docs: update deployment section with dual-link to rocmfpx-server and q38rocm
0d9a5d3
verified

julianmb commited on

integrity: update SHA256SUMS with all 6 quantization variants
eda2f57
verified

julianmb commited on

weights: upload Qwen3.8-27B-ROCmFP4-STRIX_LEAN.gguf (13.83 GiB) GGUF
89594a3
verified

julianmb commited on

weights: upload Qwen3.8-27B-Q3_K_M.gguf (12.57 GiB) GGUF
7fc80ab
verified

julianmb commited on

weights: upload Qwen3.8-27B-Q3_K_S.gguf (11.41 GiB) GGUF
6fbfd39
verified

julianmb commited on

weights: upload Qwen3.8-27B-ROCmFP2.gguf (8.57 GiB) GGUF
14e634d
verified

julianmb commited on

docs: add 8-bit memory bandwidth vs register execution breakdown
5d3fea7
verified

julianmb commited on

docs: add why ROCmFP4 improves performance and upstream ROCmFPX attribution
f098642
verified

julianmb commited on

docs: clarify 256-bit memory bus bandwidth math and deep spec workloads
b51ceea
verified

julianmb commited on

weights: upload Qwen 3.8 27B ROCmFP8 (26.25 GiB / 8.25 bpw) GGUF
e439c12
verified

julianmb commited on

integrity: add Qwen3.8-27B-ROCmFP8.gguf SHA256 checksum
a43a016
verified

julianmb commited on

config: update params.json with ROCmFP8 file entry
1df8ba3
verified

julianmb commited on

docs: add ROCmFP8 (8.25 bpw) model documentation
e32aa49
verified

julianmb commited on

docs: add context window vs prefill & decode scaling benchmark table
67c5a7b
verified

julianmb commited on

docs: add 64GB Strix Halo hardware sweet spot documentation
70718ed
verified

julianmb commited on

docs: add YAML model-index evaluation metrics and GGUF inspection snippet
5d755f9
verified

julianmb commited on

docs: add table of contents, context memory scaling, and python client snippets
f27907d
verified

julianmb commited on

docs: link GitHub deployment repository and add badges
73b356f
verified

julianmb commited on

integrity: add SHA256 checksums
088ada9
verified

julianmb commited on

license: add Apache 2.0 license file
29d56a1
verified

julianmb commited on

docs: update model card with backend requirements, exact benchmarks, and safety notes
0e3a9b9
verified

julianmb commited on

weights: upload Qwen 3.8 27B ROCmFP4_FAST (13.55 GiB) GGUF
ebedbc3
verified

julianmb commited on

lfs: add gitattributes for LFS tracking
3efa9ed
verified

julianmb commited on

config: add deployment parameters
cdd98a2
verified

julianmb commited on

config: add model and ROCmFP4 quantization configuration
f35836e
verified

julianmb commited on

docs: add comprehensive model card and benchmarks for Strix Halo
f4d913b
verified

julianmb commited on

initial commit
32f620e
verified

julianmb commited on