DiggTop

NVIDIA CMP 170HX x2 vs RTX 3090

Best verified output tok/s per model (single-stream generation). Hover a value for the quant.

NVIDIA CMP 170HX x21 verified run · best 186.9 tok/s
RTX 309016 verified runs · best 709.5 tok/s
ModelNVIDIA CMP 170HX x2RTX 3090
LFM2.5-1.2B-Instruct709.5 Q4_K_M
Qwen3.5-0.8B-MTP476.1 Q6_K_XL
NVIDIA-Nemotron-3.5-Lightning-30B-A3B353.7 NVFP4
LFM2.5-2.6B305.6 Q4_K_M
Qwen3.5-4B-MTP240.4 Q6_K_XL
Qwen3.8-Flash-Next186.9 W4A16-FP8PLE38.6 EXL3 2.50bpw
Qwen3.8-27B164.6 EXL3-3.5bpw
Qwen3.5-9B-MTP164.3 Q6_K_XL
Qwen/Qwen3.8-27B136.8 AWQ-INT4 W4A16
Ornstein3.6-27B-MTP-NSC-ACE-SABER32.9 Q4_K_M

Head-to-head (models tested on both): NVIDIA CMP 170HX x2 1 · RTX 3090 0 · tied 0 · data as of Sep 23, 2026. Full rules: methodology.

Related reading: RTX 5090 vs 3090 · quantization · Value index · Full board