gpu4.pics
data via LocalScore
NVIDIA RTX PRO 6000 Blackwell Server Edition
95 GB VRAM NVIDIA
running Qwen2.5 14B Instruct· Q4_K_M· 14.8B
17.9
tokens / sec
438 · Passable #32 of 373
Generation
17.9tok/s
higher is better
Prompt / prefill
2,581tok/s
higher is better
Time to first token
637 ms
lower is better
Composite score
438
Model size
14.8B
Runtime
gpu4.pics/r/ls-nvidia-rtx-pro-6000-blackwell-server-edition-qwen25-14b-instruct-q4-k-m

All benchmarks on this rig

ModelQuantGenPromptTTFTPowerPerf/W$/MtokScore
Qwen2.5 14B Instruct14.8BQ4_K_M17.92,581637 ms438

How it stacks up — Qwen2.5 14B Instruct

NVIDIA RTX PRO 6000 Blackwell Server Edition
17.9
NVIDIA H100
72.2
NVIDIA RTX PRO 6000 Blackwell Workstation Edition
70.8
NVIDIA A100 80GB
66.3
NVIDIA RTX 3090 Ti
64.2
NVIDIA RTX 3090
59.9
NVIDIA RTX A6000
52