Modell-Vergleich
Welche KI ist am besten für Strix Halo? Vergleich von Cloud-APIs und lokalen Modellen — mit Live-Daten aus Artificial Analysis, lmspeed.net und Community-Benchmarks.
Ryzen AI MAX+ PRO 395·RDNA 3.5 (40 CUs)·LPDDR5X-8533 (94 GB)·ROCm gfx1151
Cloud-API Intelligence Leaderboard
Daten: 49 Modelle · Stand: 13. August 2026 · Quellen: Artificial Analysis, lmspeed.net, ollamatps.com
| # | Modell | Anbieter | Intelligence ↓ | Speed (tok/s) | Latenz | Kosten | Kontext |
|---|---|---|---|---|---|---|---|
| 1 | Claude Opus 5 | Anthropic | 63Exzellent | 52 | 63.92s | $2.34 | 1M |
| 2 | Claude Fable 5 (mit Fallback) | Anthropic | 62Exzellent | 107.76 | 115.82s | $3.14 | 1M |
| 3 | GPT-5.6 Sol | OpenAI | 61Exzellent | 176.57 | 184.67s | $1.23 | 1M |
| 4 | Grok 4.6 | xAI | 61Exzellent | 32.3 | 39.98s | $0.84 | 500k |
| 5 | Claude Opus 5 (high) | Anthropic | 61Exzellent | 12.85 | 22.58s | $1.23 | 1M |
| 6 | Kimi K3 | Moonshot AI | 60Exzellent | 3.58 | 65.59s | $0.84 | 1.05M |
| 7 | Qwen3.7 Max | Alibaba | 58Sehr stark | 47 | 2.61s | $1.13 | 1M |
| 8 | GPT-5.6 Terra (max) | OpenAI | 57Sehr stark | 113 | 198.53s | $0.51 | 1M |
| 9 | Gemini 3.7 Flash (high) | 56Sehr stark | 340 | 9.83s | $0.40 | 1M | |
| 10 | Claude Sonnet 5 | Anthropic | 55Sehr stark | 184.37 | 191.81s | $1.72 | 1M |
| 11 | GLM-5.2 | Z.AI | 53Sehr stark | 115 | 1.39s | $0.32 | 1M |
| 12 | DeepSeek V4 Pro | DeepSeek | 53Sehr stark | 80 | 1.82s | $0.06 | 1M |
| 13 | Gemini 3.7 Flash (medium) | 53Sehr stark | 274 | 4.22s | $0.26 | 1M | |
| 14 | GPT-5.6 Luna (max) | OpenAI | 52Sehr stark | 150 | 155.88s | $0.05 | 1M |
| 15 | Gemini 3.6 Flash | 52Sehr stark | 238 | 18.23s | $0.56 | 1M | |
| 16 | GLM 5.2 | Ollama Cloud Pro | 51.1Sehr stark | 114.5 | — | — | — |
| 17 | DeepSeek V4 Flash 0731 | Ollama Cloud Pro | 49.9Stark | 147 | — | — | — |
| 18 | Kimi K2.6 | Ollama Cloud Pro | 44.2Stark | 93.2 | — | — | — |
| 19 | Kimi K2.7 Code | Ollama Cloud Pro | 41.9Stark | 109.1 | — | — | — |
| 20 | DeepSeek V4 Flash | Ollama Cloud Pro | 40.3Stark | 258.1 | — | — | — |
| 21 | GLM 5.1 | Ollama Cloud Pro | 40.2Stark | 88.2 | — | — | — |
| 22 | Qwen3.6 27B | Alibaba | 38Solide | 53 | 3.81s | $0.29 | 262k |
| 23 | Qwen3.5 397B | Ollama Cloud Pro | 33.7Solide | 58.2 | — | — | — |
| 24 | Qwen3.6 35B A3B | Alibaba | 32Solide | 147 | 2.29s | $0.29 | 262k |
| 25 | Gemma 4 31B | 30Solide | 36 | 1.13s | Kostenlos | 256k | |
| 26 | Gemma4 31B | Ollama Cloud Pro | 29.4Solide | 88.6 | — | — | — |
| 27 | Nemotron 3 Super | Ollama Cloud Pro | 25.4Solide | 94.5 | — | — | — |
| 28 | GPT-OSS 120B | OpenAI | 23.8Einsteiger | 169 | 12.74s | — | 131k |
| 29 | Llama 4 Maverick | Meta | 22.63Einsteiger | 131 | 1.02s | Kostenlos | 256k |
| 30 | Mistral Large 3 | Mistral | 16Einsteiger | 42 | 1.23s | $0.08 | 256k |
| 31 | Mistral Large 3 675B | Ollama Cloud Pro | 15.9Einsteiger | 56.9 | — | — | — |
| 32 | GPT-OSS 20B | OpenAI | 14.9Basic | 313 | 0.65s | — | — |
| 33 | Nemotron 3 Nano 30B | NVIDIA | 7.4Basic | 260 | 9s | — | — |
| 34 | Celeris-1 | Celeris | —— | 1644 | 0.62s | — | — |
| 35 | Mercury 2 | Inception | —— | 813 | 2.78s | — | 128k |
| 36 | Step 3.7 Flash | StepFun | —— | 401 | 5.86s | — | 262k |
| 37 | Ling 3.0 Flash | InclusionAI | —— | 394 | 7.12s | — | 262k |
| 38 | Gemini 3.5 Flash-Lite | —— | 365 | 10.33s | — | 1M | |
| 39 | LFM2.5-8B-A1B | LiquidAI | —— | 337 | 7.27s | — | — |
| 40 | Nemotron 3 Nano Omni 30B A3B | NVIDIA | —— | 328 | 7.11s | — | — |
| 41 | Gemini 3.1 Flash-Lite | —— | 308 | 6.02s | — | — | |
| 42 | GPT-5.4 mini | OpenAI | —— | 201 | 3.85s | — | — |
| 43 | Gemini 3 Flash | —— | 177 | 0.81s | — | — | |
| 44 | Qwen3.5-35B-A3B | Alibaba | —— | 153 | 15.3s | — | 262k |
| 45 | GLM-4.7-Flash | Z.AI | —— | 96 | 22.26s | — | — |
| 46 | o3-mini | OpenAI | —— | 160 | 7.12s | — | 200k |
| 47 | Qwen3.6-35B-A3B | Alibaba | —— | 148 | 38.68s | — | 262k |
| 48 | Llama 4 Scout | Meta | —— | 122 | 0.84s | — | 256k |
| 49 | Command A+ | Cohere | —— | 181 | 11.48s | — | 192k |
💡 Wichtiger Unterschied
Cloud-APIs messen auf A100/H100 Servern — ihre tok/s sind 5–20× höher als lokal auf Strix Halo. Der Intelligence-Score von Artificial Analysis ist hardware-unabhängig und erlaubt fairen Vergleich.