DiggTop

DGX Spark x1 vs RTX 5090

Best verified output tok/s per model (single-stream generation). Hover a value for the quant.

DGX Spark x13 verified runs · best 72.0 tok/s
RTX 509024 verified runs · best 2231.4 tok/s
ModelDGX Spark x1RTX 5090
LFM2-350M-NVFP4A162231.4 NVFP4
NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4446.7 NVFP4
Qwen3.8-27B435.1 IQ4_XS
Ornith-1.0-35B-PrismaAURA-4.75bit-vllm-MTP283.1 NVFP4
Kimi-Linear-48B-A3B-Instruct280.8 IQ4_XS
Ornith-1.5-35B-A3B-NVFP4258.8 NVFP4
North-Mini-Code-1.0258.4 UD-Q6_K_XL
Qwen3.6-35B-A3B-MTP-GGUF222.9 Unsloth-Dynamic-IQ4_XS
Laguna-XS-2.1-NVFP4216.7 NVFP4
Qwen3.8-27B-nvfp4-NInfer213.0 NVFP4
Laguna-XS-2.1-INT4206.2 INT4
KAT-Coder-V2.5-Dev-AWQ-W4A16-ASYM201.2 W4A16
Ornith-1.0-35B-AWQ-INT4196.6 AWQ
Qwen3.8-27B-GPTQ-W4A16137.9 W4A16
Muse-Glimmer-30B-NVFP4124.8 NVFP4
Qwen3.6-27B-NVFP4120.9 NVFP4
Huihui-Qwen3.8-27B-abliterated-NVFP4117.7 NVFP4
Qwen3.8-27B-W4A16-AWQ108.0 W4A16
Qwen3.8-27B-5090-goldilocks-GGUF93.5 Q6_K
Qwen3.8-27B-GGUF79.4 UD-Q6_K
Qwen3.8-Flash-Next72.0 EXL3
Qwen3.6-27B-MTP-GGUF28.3 Q5_K_M
DeepSeek-V4-Flash-0731-MXFP4-GGUF26.4 MXFP4
Qwen3.8-27B-FP816.8 FP8
Qwen3.6-27B-GGUF4.1 UD-Q5_K_XL

25 rows · 1 models on DGX Spark x1, 24 on RTX 5090 — no verified overlap yet, each side shows its own bests · data as of Sep 18, 2026. Full rules: methodology.

Related reading: RTX 5090 vs 3090 · quantization · Value index · Full board