Local AI Fleet: M3 Ultra + 5090 Benchmarks
Jul 18, 2026 · 570 messages · 68 active members
@geilt shared a full breakdown of a Mac Studio M3 Ultra (512GB) with RTX 5090 eGPU running Ollama and MLX. Qwen3 30B-A3B MoE hit ~110 t/s, outperforming dense 32B models by ~4x, while Qwen3 0.6B reached ~293 t/s for fast…
Read full digest →