Jun 29, 2026AI Infrastructure
Qwen3 235B MoE vs Llama 3.3 70B Dense on M5 Ultra Mac Studio: Tokens Per Second, Memory, and Cost Per Million Tokens (June 2026)
Qwen3 235B MoE and Llama 3.3 70B Dense compared on a 512GB M5 Ultra Mac Studio under mlx-lm. Tokens per second, peak memory, sustained throughput, and cost per million tokens for a local production inference workload in 2026.