DiggTop

Qwen3.8-Flash-Next-W4A16-FP8PLE

Qwen family · 176.0B params

1recorded run
186.9best tok/s
1verified
Fastest GPUs for this model (best tok/s)
  1. NVIDIA CMP 170HX x2186.9

All benchmarks Methodology

GPUModelQuantBackendCtx tok/sprompt tok/sVRAM GBSource
NVIDIA CMP 170HX x2 · 64 GBQwen3.8-Flash-Next-W4A16-FP8PLEW4A16-FP8PLEvllm 0.29.0262052186.9 src