I Ran Qwen3-Coder 30B on an AMD RX 9070 XT — 47 tok/s, No ROCm Required
Real llama-bench numbers for Qwen3-Coder-30B-A3B on an AMD RX 9070 XT (16GB, RDNA4) using llama.cpp with Vulkan — including the full n-cpu-moe sweep that took generation from 21 to 47 tok/s.