ZixiQi commited on
Commit
9669248
·
verified ·
1 Parent(s): c7b1d3b

Add per-position accept rate to Performance table

Browse files
Files changed (1) hide show
  1. README.md +4 -4
README.md CHANGED
@@ -27,7 +27,7 @@ The draft is a 1-layer dense Llama (`LlamaForCausalLMEagle3`) on MiniMax-M3's `h
27
 
28
  Mean accepted length and draft accept rate measured end-to-end against `MiniMaxAI/MiniMax-M3-MXFP8` served with vLLM at `tensor-parallel-size=4`, `num_speculative_tokens=3`, greedy sampling (`temperature=0`, `top_p=1.0`), `max-concurrency=16`.
29
 
30
- | Dataset | n | Mean accepted length | Draft accept rate |
31
- |---|---:|---:|---:|
32
- | MT-Bench | 64 | 2.668 | 55.62% |
33
- | SPEED-Bench (qualitative) | 64 | 2.561 | 52.04% |
 
27
 
28
  Mean accepted length and draft accept rate measured end-to-end against `MiniMaxAI/MiniMax-M3-MXFP8` served with vLLM at `tensor-parallel-size=4`, `num_speculative_tokens=3`, greedy sampling (`temperature=0`, `top_p=1.0`), `max-concurrency=16`.
29
 
30
+ | Dataset | n | Mean accepted length | Draft accept rate | Per-position accept rate (pos 1 / 2 / 3) |
31
+ |---|---:|---:|---:|---:|
32
+ | MT-Bench | 64 | 2.668 | 55.62% | 0.745 / 0.537 / 0.387 |
33
+ | SPEED-Bench (qualitative) | 64 | 2.561 | 52.04% | 0.719 / 0.500 / 0.342 |