Compare
Loading community benchmarks…
Loading community benchmarks…
Put two chips, runtimes, or runtime versions side by side. Everything else is held fixed or called out, so a ratio is worth exactly what the matched runs say.
Ratios read side A relative to side B. Geometric mean over 28 like-for-like pairs.
| Facet | AMD Radeon RX 7900 XT (RADV NAVI31) | Apple M5 Pro |
|---|---|---|
| Model | Gemma-4-E4B-It, Gpt-Oss-20B, Llama 3.2 3B Instruct, Llama-3.1-8B-Instruct, Llama-3.2-3B-Instruct, Qwen3-0.6B, Qwen3-30B-A3B-Instruct-2507, Qwen3-4B-Instruct-2507, Qwen3-8B, Qwen3.6-27B, Qwen3.6-35B-A3B | gemma-3-1b-it, gemma-4-26B-A4B-it, gemma-4-E2B-it, gemma-4-E4B-it, Gemma-4-E4B-It, gpt-oss-20b, Gpt-Oss-20B, Llama 3.2 3B Instruct, Llama-3.1-8B-Instruct, Llama-3.2-1B-Instruct, Llama-3.2-3B-Instruct, Mistral-7B-Instruct-v0.3, Muse-Glimmer-30B, NVIDIA-Nemotron-3-Nano-30B-A3B, Qwen3-0.6B, Qwen3-1.7B, Qwen3-30B-A3B-Instruct-2507, Qwen3-30B-A3B-Thinking-2507, Qwen3-4B, Qwen3-4B-Instruct-2507, Qwen3-4B-Thinking-2507, Qwen3-8B, Qwen3-8B-base-q2, Qwen3-8B-base-q3, Qwen3-8B-base-q5, Qwen3-8B-base-q6, Qwen3.5-2B, Qwen3.5-2B-Base, Qwen3.5-35B-A3B, Qwen3.6-27B, Qwen3.6-35B-A3B, Qwen3.8-27B, Tinystories Lay8 Hs512 Hd8 33M, tinystories-lay8-hs512-hd8-33M |
| Runtime | llama.cpp | BaseRT, llama.cpp |
| Runtime version | llama.cpp b10809 (5266f24da) | BaseRT 0.2.4, BaseRT 0.2.5, llama.cpp b10809 (5266f24da), llama.cpp b9960 (a935fbffe) |
| Quantisation | BF16, F16, Q2_K, Q3_K_M, Q4_0, Q4_1, Q4_K_M, Q5_K_M, Q6_K, Q8_0 | BF16, F16, mxfp4, passthrough_gguf, Q2, Q2_K, Q3, Q3_K_M, Q4, Q4_0, Q4_1, Q4_K_M, Q5, Q5_K_M, Q6, Q6_K, Q8, Q8_0 |
| Backend | Vulkan | BLAS + Metal, Metal |
| Cooldown | off | off, on |
| Conditioning | runtime_native_warmup | idle_reset_then_warm, runtime_native_warmup, warmup_only |
| Decode workload | TG128 | TG128, TG128 @ 1 ctx |
| Harness schema | computearena-measurements/1 | basert-benchmark-harness/1, computearena-measurements/1 |
Each row is a configuration present on both sides. Values are per-cell medians; ratios read AMD Radeon RX 7900 XT (RADV NAVI31) relative to Apple M5 Pro.
| Configuration | Decode A | Decode B | Ratio | Prefill A | Prefill B | Ratio | Runs A / B |
|---|---|---|---|---|---|---|---|
Qwen3-0.6B llama.cppQ4_K_M | 500.4 | 358.1 | 1.40× | 26,050 | 14,509 | 1.80× | 2 / 3 |
gemma-4-E4B-it llama.cppQ4_K_M | 124.7 | 70.7 | 1.76× | 4,152 | 2,249 | 1.85× | 2 / 2 |
Llama-3.1-8B-Instruct llama.cppQ4_K_M | 121.2 | 55.5 | 2.18× | 2,749 | 1,423 | 1.93× | 2 / 2 |
Llama-3.2-3B-Instruct llama.cppQ4_K_M | 226.6 | 116.5 | 1.95× | 5,729 | 3,316 | 1.73× | 2 / 2 |
Qwen3-30B-A3B-Instruct-2507 llama.cppQ4_K_M | 184.0 | 95.1 | 1.93× | 2,847 | 1,838 | 1.55× | 2 / 2 |
Qwen3-4B-Instruct-2507 llama.cppQ4_K_M | 182.7 | 93.5 | 1.95× | 4,788 | 2,567 | 1.87× | 2 / 2 |
Qwen3.6-27B llama.cppQ4_K_M | 33.1 | 14.9 | 2.23× | 782 | 375 | 2.09× | 2 / 2 |
Qwen3-8B llama.cppQ2_K | 148.5 | 71.2 | 2.09× | 2,546 | 1,471 | 1.73× | 2 / 2 |
Qwen3-8B llama.cppQ3_K_M | 128.8 | 61.2 | 2.10× | 2,479 | 1,416 | 1.75× | 2 / 2 |
Qwen3-8B llama.cppQ4_K_M | 116.9 | 54.3 | 2.15× | 2,634 | 1,399 | 1.88× | 2 / 2 |
Qwen3-8B llama.cppQ5_K_M | 105.3 | 47.7 | 2.21× | 2,635 | 1,349 | 1.95× | 2 / 2 |
Qwen3-8B llama.cppQ6_K | 92.1 | 41.0 | 2.25× | 2,464 | 1,414 | 1.74× | 2 / 2 |
Qwen3-8B llama.cppQ8_0 | 72.5 | 31.8 | 2.28× | 2,461 | 1,460 | 1.69× | 2 / 2 |
gemma-4-E4B-it llama.cppQ8_0 | 95.6 | 47.9 | 2.00× | 4,214 | 2,346 | 1.80× | 1 / 1 |
gpt-oss-20b llama.cppF16 | 146.8 | 66.6 | 2.20× | 3,262 | 1,852 | 1.76× | 1 / 1 |
gpt-oss-20b llama.cppQ4_K_M | 195.6 | 96.3 | 2.03× | 3,292 | 1,849 | 1.78× | 1 / 1 |
Llama-3.1-8B-Instruct llama.cppQ4_0 | 126.7 | 58.7 | 2.16× | 2,959 | 1,538 | 1.92× | 1 / 1 |
Llama-3.1-8B-Instruct llama.cppQ6_K | 97.7 | 43.4 | 2.25× | 2,512 | 1,421 | 1.77× | 1 / 1 |
Llama-3.1-8B-Instruct llama.cppQ8_0 | 68.6 | 29.6 | 2.32× | 2,286 | 1,465 | 1.56× | 1 / 1 |
Llama-3.2-3B-Instruct llama.cppQ8_0 | 167.5 | 76.6 | 2.19× | 5,846 | 3,516 | 1.66× | 1 / 1 |
Qwen3-0.6B llama.cppQ8_0 | 479.4 | 283.0 | 1.69× | 26,346 | 14,942 | 1.76× | 1 / 1 |
Qwen3-30B-A3B-Instruct-2507 llama.cppQ2_K | 198.1 | 102.7 | 1.93× | 2,837 | 1,893 | 1.50× | 1 / 1 |
Qwen3-30B-A3B-Instruct-2507 llama.cppQ3_K_M | 184.5 | 97.3 | 1.90× | 2,474 | 1,708 | 1.45× | 1 / 1 |
Qwen3-4B-Instruct-2507 llama.cppQ8_0 | 134.3 | 60.8 | 2.21× | 4,824 | 2,686 | 1.80× | 1 / 1 |
Qwen3.6-27B llama.cppQ3_K_M | 36.8 | 16.7 | 2.20× | 739 | 373 | 1.98× | 1 / 1 |
Qwen3.6-35B-A3B llama.cppQ3_K_M | 124.1 | 67.5 | 1.84× | 2,597 | 1,737 | 1.50× | 1 / 1 |
Qwen3-8B llama.cppBF16 | 45.6 | 18.9 | 2.41× | 1,168 | 1,376 | 0.85× | 1 / 1 |
Qwen3-8B llama.cppQ4_1 | 115.6 | 51.9 | 2.23× | 2,902 | 1,535 | 1.89× | 1 / 1 |
Top 25 of 41 runs by decode throughput.
| Model / format | Chip / backend | Decode | Prefill | Contributor | Date | Report |
|---|---|---|---|---|---|---|
Qwen3-0.6B llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 508.8 TG128 | 26,137 PP512 | arki05 | View Benchmark | |
Qwen3-0.6B llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 491.9 TG128 | 25,964 PP512 | arki05 | View Benchmark | |
Qwen3-0.6B llama.cpp b10809 (5266f24da)Q8_0 | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 479.4 TG128 | 26,346 PP512 | arki05 | View Benchmark | |
Llama-3.2-3B-Instruct llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 229.7 TG128 | 5,737 PP512 | arki05 | View Benchmark | |
Llama-3.2-3B-Instruct llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 223.4 TG128 | 5,721 PP512 | arki05 | View Benchmark | |
Qwen3-30B-A3B-Instruct-2507 llama.cpp b10809 (5266f24da)Q2_K | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 198.1 TG128 | 2,837 PP512 | arki05 | View Benchmark | |
Gpt-Oss-20B llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 195.6 TG128 | 3,292 PP512 | arki05 | View Benchmark | |
Qwen3-30B-A3B-Instruct-2507 llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 186.7 TG128 | 2,868 PP512 | arki05 | View Benchmark | |
Qwen3-4B-Instruct-2507 llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 185.1 TG128 | 4,783 PP512 | arki05 | View Benchmark | |
Qwen3-30B-A3B-Instruct-2507 llama.cpp b10809 (5266f24da)Q3_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 184.5 TG128 | 2,474 PP512 | arki05 | View Benchmark | |
Qwen3-30B-A3B-Instruct-2507 llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 181.3 TG128 | 2,827 PP512 | arki05 | View Benchmark | |
Qwen3-4B-Instruct-2507 llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 180.3 TG128 | 4,793 PP512 | arki05 | View Benchmark | |
Llama 3.2 3B Instruct llama.cpp b10809 (5266f24da)Q8_0 | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 167.5 TG128 | 5,846 PP512 | arki05 | View Benchmark | |
Qwen3-8B llama.cpp b10809 (5266f24da)Q2_K | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 150.7 TG128 | 2,528 PP512 | arki05 | View Benchmark | |
Gpt-Oss-20B llama.cpp b10809 (5266f24da)F16 | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 146.8 TG128 | 3,262 PP512 | arki05 | View Benchmark | |
Qwen3-8B llama.cpp b10809 (5266f24da)Q2_K | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 146.2 TG128 | 2,563 PP512 | arki05 | View Benchmark | |
Qwen3-4B-Instruct-2507 llama.cpp b10809 (5266f24da)Q8_0 | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 134.3 TG128 | 4,824 PP512 | arki05 | View Benchmark | |
Qwen3-8B llama.cpp b10809 (5266f24da)Q3_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 130.2 TG128 | 2,459 PP512 | arki05 | View Benchmark | |
Qwen3-8B llama.cpp b10809 (5266f24da)Q3_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 127.3 TG128 | 2,498 PP512 | arki05 | View Benchmark | |
Llama-3.1-8B-Instruct llama.cpp b10809 (5266f24da)Q4_0 | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 126.7 TG128 | 2,959 PP512 | arki05 | View Benchmark | |
Gemma-4-E4B-It llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 126.6 TG128 | 4,142 PP512 | arki05 | View Benchmark | |
Qwen3.6-35B-A3B llama.cpp b10809 (5266f24da)Q3_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 124.1 TG128 | 2,597 PP512 | arki05 | View Benchmark | |
Gemma-4-E4B-It llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 122.8 TG128 | 4,161 PP512 | arki05 | View Benchmark | |
Llama-3.1-8B-Instruct llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 122.7 TG128 | 2,743 PP512 | arki05 | View Benchmark | |
Llama-3.1-8B-Instruct llama.cpp b10809 (5266f24da)Q4_K_M | AMD Radeon RX 7900 XT (RADV NAVI31) Vulkan | 119.8 TG128 | 2,756 PP512 | arki05 | View Benchmark |
Top 25 of 129 runs by decode throughput.
| Model / format | Chip / backend | Decode | Prefill | Contributor | Date | Report |
|---|---|---|---|---|---|---|
ivnle/tinystories-lay8-hs512-hd8-33M BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 2,068.0 TG128 | 190,107 PP512 | arki05 | View Benchmark | |
Tinystories Lay8 Hs512 Hd8 33M llama.cpp b10809 (5266f24da)Q4_0 | Apple M5 Pro BLAS + Metal | 1,443.3 TG128 | 124,181 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-0.6B BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 516.8 TG128 | 20,778 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-0.6B BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 512.0 TG128 | 20,603 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-0.6B BaseRT 0.2.5Q4 | Apple M5 Pro Metal | 481.5 TG128 @ 1 ctx | 19,595 PP512 | isu | View Benchmark | |
Qwen3-0.6B llama.cpp b10809 (5266f24da)Q4_K_M | Apple M5 Pro BLAS + Metal | 358.3 TG128 | 14,509 PP512 | arki05 | View Benchmark | |
Qwen3-0.6B llama.cpp b10809 (5266f24da)Q4_K_M | Apple M5 Pro BLAS + Metal | 358.1 TG128 | 14,344 PP512 | arki05 | View Benchmark | |
Qwen3-0.6B llama.cpp b10809 (5266f24da)Q4_K_M | Apple M5 Pro BLAS + Metal | 356.2 TG128 | 14,552 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-0.6B BaseRT 0.2.4Q8 | Apple M5 Pro Metal | 350.2 TG128 | 20,537 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-0.6B BaseRT 0.2.4Q8 | Apple M5 Pro Metal | 349.8 TG128 | 20,366 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-0.6B BaseRT 0.2.4Q8 | Apple M5 Pro Metal | 311.0 TG128 | 18,474 PP512 | arki05 | View Benchmark | |
basecompute/gemma-3-1b-it BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 293.1 TG128 | 15,066 PP512 | arki05 | View Benchmark | |
Qwen3-0.6B llama.cpp b10809 (5266f24da)Q8_0 | Apple M5 Pro BLAS + Metal | 283.0 TG128 | 14,942 PP512 | arki05 | View Benchmark | |
basecompute/gemma-3-1b-it BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 270.4 TG128 | 13,717 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-1.7B BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 235.4 TG128 | 8,040 PP512 | arki05 | View Benchmark | |
basecompute/Llama-3.2-1B-Instruct BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 229.1 TG128 | 11,673 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3.5-2B-Base BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 218.2 TG128 | 2,645 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3.5-2B BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 217.7 TG128 | 2,641 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-1.7B BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 210.3 TG128 | 7,268 PP512 | arki05 | View Benchmark | |
basecompute/gemma-3-1b-it BaseRT 0.2.4Q8 | Apple M5 Pro Metal | 210.3 TG128 | 15,061 PP512 | arki05 | View Benchmark | |
basecompute/Llama-3.2-1B-Instruct BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 206.3 TG128 | 10,528 PP512 | arki05 | View Benchmark | |
basecompute/Llama-3.2-1B-Instruct BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 205.3 TG128 | 12,067 PP512 | arki05 | View Benchmark | |
basecompute/gemma-4-E2B-it BaseRT 0.2.4Q4 | Apple M5 Pro Metal | 144.6 TG128 | 13,240 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3-1.7B BaseRT 0.2.4Q8 | Apple M5 Pro Metal | 139.7 TG128 | 8,043 PP512 | arki05 | View Benchmark | |
basecompute/Qwen3.5-2B-Base BaseRT 0.2.4Q8 | Apple M5 Pro Metal | 131.4 TG128 | 2,642 PP512 | arki05 | View Benchmark |