M2 Ultra 192GB vs RTX 4090
For running local LLMs · 5 reports across 3 models
Tokens per second by model
| Model | M2 Ultra 192GB | RTX 4090 |
|---|---|---|
| Gemma 4up to 31B | — | 149.6n=2 |
| Qwen3.6up to 35B | — | 80.0n=2 |
| DeepSeek V3 | 28.0n=1 | — |
For running local LLMs · 5 reports across 3 models
| Model | M2 Ultra 192GB | RTX 4090 |
|---|---|---|
| Gemma 4up to 31B | — | 149.6n=2 |
| Qwen3.6up to 35B | — | 80.0n=2 |
| DeepSeek V3 | 28.0n=1 | — |