FastFlowLM commited on
Commit
d031470
·
verified ·
1 Parent(s): b2f9f9d

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +8 -8
README.md CHANGED
@@ -207,10 +207,10 @@ We report prefill throughput evaluated over a range of prompt lengths.
207
 
208
  | Platform / Device | Inference | Framework | Model | 1K Prefill (tok/s) | 4K Prefill (tok/s) | 16K Prefill (tok/s) | Memory |
209
  |----------------------------------------------------|-----------|------------------|-------------------|-------------------:|-------------------:|--------------------:| -------:|
210
- | AMD Ryzen™ AI 395+ | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,487 | 2,226 | 1,670 | 1.7 GB (full context) |
211
- | AMD Ryzen™ AI 9 HX 370 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,487 | 2,226 |1,670 | 1.7 GB (full context) |
212
- | AMD Ryzen™ AI 7 HX 350 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,431 | 2,032 |1,519 | 1.7 GB (full context) |
213
- | AMD Ryzen™ AI 5 HX 340 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,431 | 2,032 |1,519 | 1.7 GB (full context) |
214
  | AMD Ryzen™ AI 9 HX 370 | CPU | llama.cpp (Q4_0) | LFM2.5-1.2B-Thinking| 2,975 | N/A | N/A | 856 MB |
215
  | Qualcomm Snapdragon® X Elite | NPU | NexaML | LFM2.5-1.2B-Thinking| 2,591 | N/A | N/A | 0.9 GB |
216
  | Qualcomm Snapdragon® Gen4 (ROG Phone 9 Pro) | NPU | NexaML | LFM2.5-1.2B-Thinking| 4,391 | N/A | N/A | 0.9 GB |
@@ -223,10 +223,10 @@ The reported results correspond to decoding 100 tokens at different context leng
223
 
224
  | Platform / Device | Inference | Framework | Model | Decode @1K (tok/s) | Decode @4K (tok/s) | Decode @16K (tok/s) | Memory |
225
  |----------------------------------------------------|-----------|------------------|-------------------|-------------------:|-------------------:|--------------------:| -------:|
226
- | AMD Ryzen™ AI 395+ | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 60 | 54 | 49 | 1.7 GB (full context) |
227
- | AMD Ryzen™ AI 9 HX 370 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 57 | 54 |49 | 1.7 GB (full context) |
228
- | AMD Ryzen™ AI 7 HX 350 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 63 | 59 |52 | 1.7 GB (full context) |
229
- | AMD Ryzen™ AI 5 HX 340 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 63 | 59 |52 | 1.7 GB (full context) |
230
  | AMD Ryzen™ AI 9 HX 370 | CPU | llama.cpp (Q4_0) | LFM2.5-1.2B-Thinking| 116 | N/A | N/A | 856 MB |
231
  | Qualcomm Snapdragon® X Elite | NPU | NexaML | LFM2.5-1.2B-Thinking| 63 | N/A | N/A | 0.9 GB |
232
  | Qualcomm Snapdragon® Gen4 (ROG Phone 9 Pro) | NPU | NexaML | LFM2.5-1.2B-Thinking| 82 | N/A | N/A | 0.9 GB |
 
207
 
208
  | Platform / Device | Inference | Framework | Model | 1K Prefill (tok/s) | 4K Prefill (tok/s) | 16K Prefill (tok/s) | Memory |
209
  |----------------------------------------------------|-----------|------------------|-------------------|-------------------:|-------------------:|--------------------:| -------:|
210
+ | AMD Ryzen™ AI 395+ | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,487 | 2,226 | 1,670 | 1.6 GB (full context) |
211
+ | AMD Ryzen™ AI 9 HX 370 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,487 | 2,226 |1,670 | 1.6 GB (full context) |
212
+ | AMD Ryzen™ AI 7 HX 350 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,431 | 2,032 |1,519 | 1.6 GB (full context) |
213
+ | AMD Ryzen™ AI 5 HX 340 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 1,431 | 2,032 |1,519 | 1.6 GB (full context) |
214
  | AMD Ryzen™ AI 9 HX 370 | CPU | llama.cpp (Q4_0) | LFM2.5-1.2B-Thinking| 2,975 | N/A | N/A | 856 MB |
215
  | Qualcomm Snapdragon® X Elite | NPU | NexaML | LFM2.5-1.2B-Thinking| 2,591 | N/A | N/A | 0.9 GB |
216
  | Qualcomm Snapdragon® Gen4 (ROG Phone 9 Pro) | NPU | NexaML | LFM2.5-1.2B-Thinking| 4,391 | N/A | N/A | 0.9 GB |
 
223
 
224
  | Platform / Device | Inference | Framework | Model | Decode @1K (tok/s) | Decode @4K (tok/s) | Decode @16K (tok/s) | Memory |
225
  |----------------------------------------------------|-----------|------------------|-------------------|-------------------:|-------------------:|--------------------:| -------:|
226
+ | AMD Ryzen™ AI 395+ | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 60 | 54 | 49 | 1.6 GB (full context) |
227
+ | AMD Ryzen™ AI 9 HX 370 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 57 | 54 |49 | 1.6 GB (full context) |
228
+ | AMD Ryzen™ AI 7 HX 350 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 63 | 59 |52 | 1.6 GB (full context) |
229
+ | AMD Ryzen™ AI 5 HX 340 | NPU | FastFlowLM | LFM2.5-1.2B-Thinking| 63 | 59 |52 | 1.6 GB (full context) |
230
  | AMD Ryzen™ AI 9 HX 370 | CPU | llama.cpp (Q4_0) | LFM2.5-1.2B-Thinking| 116 | N/A | N/A | 856 MB |
231
  | Qualcomm Snapdragon® X Elite | NPU | NexaML | LFM2.5-1.2B-Thinking| 63 | N/A | N/A | 0.9 GB |
232
  | Qualcomm Snapdragon® Gen4 (ROG Phone 9 Pro) | NPU | NexaML | LFM2.5-1.2B-Thinking| 82 | N/A | N/A | 0.9 GB |