Strix Halo AI Benchmarks

Modell-Vergleich

Welche KI ist am besten für Strix Halo? Vergleich von Cloud-APIs und lokalen Modellen — mit Live-Daten aus Artificial Analysis, lmspeed.net und Community-Benchmarks.

Ryzen AI MAX+ PRO 395·RDNA 3.5 (40 CUs)·LPDDR5X-8533 (94 GB)·ROCm gfx1151

Cloud-API Intelligence Leaderboard

Daten: 49 Modelle · Stand: 13. August 2026 · Quellen: Artificial Analysis, lmspeed.net, ollamatps.com

#ModellAnbieterIntelligenceSpeed (tok/s)LatenzKostenKontext
1Claude Opus 5Anthropic
63Exzellent
5263.92s$2.341M
2Claude Fable 5 (mit Fallback)Anthropic
62Exzellent
107.76115.82s$3.141M
3GPT-5.6 SolOpenAI
61Exzellent
176.57184.67s$1.231M
4Grok 4.6xAI
61Exzellent
32.339.98s$0.84500k
5Claude Opus 5 (high)Anthropic
61Exzellent
12.8522.58s$1.231M
6Kimi K3Moonshot AI
60Exzellent
3.5865.59s$0.841.05M
7Qwen3.7 MaxAlibaba
58Sehr stark
472.61s$1.131M
8GPT-5.6 Terra (max)OpenAI
57Sehr stark
113198.53s$0.511M
9Gemini 3.7 Flash (high)Google
56Sehr stark
3409.83s$0.401M
10Claude Sonnet 5Anthropic
55Sehr stark
184.37191.81s$1.721M
11GLM-5.2Z.AI
53Sehr stark
1151.39s$0.321M
12DeepSeek V4 ProDeepSeek
53Sehr stark
801.82s$0.061M
13Gemini 3.7 Flash (medium)Google
53Sehr stark
2744.22s$0.261M
14GPT-5.6 Luna (max)OpenAI
52Sehr stark
150155.88s$0.051M
15Gemini 3.6 FlashGoogle
52Sehr stark
23818.23s$0.561M
16GLM 5.2Ollama Cloud Pro
51.1Sehr stark
114.5
17DeepSeek V4 Flash 0731Ollama Cloud Pro
49.9Stark
147
18Kimi K2.6Ollama Cloud Pro
44.2Stark
93.2
19Kimi K2.7 CodeOllama Cloud Pro
41.9Stark
109.1
20DeepSeek V4 FlashOllama Cloud Pro
40.3Stark
258.1
21GLM 5.1Ollama Cloud Pro
40.2Stark
88.2
22Qwen3.6 27BAlibaba
38Solide
533.81s$0.29262k
23Qwen3.5 397BOllama Cloud Pro
33.7Solide
58.2
24Qwen3.6 35B A3BAlibaba
32Solide
1472.29s$0.29262k
25Gemma 4 31BGoogle
30Solide
361.13sKostenlos256k
26Gemma4 31BOllama Cloud Pro
29.4Solide
88.6
27Nemotron 3 SuperOllama Cloud Pro
25.4Solide
94.5
28GPT-OSS 120BOpenAI
23.8Einsteiger
16912.74s131k
29Llama 4 MaverickMeta
22.63Einsteiger
1311.02sKostenlos256k
30Mistral Large 3Mistral
16Einsteiger
421.23s$0.08256k
31Mistral Large 3 675BOllama Cloud Pro
15.9Einsteiger
56.9
32GPT-OSS 20BOpenAI
14.9Basic
3130.65s
33Nemotron 3 Nano 30BNVIDIA
7.4Basic
2609s
34Celeris-1Celeris
16440.62s
35Mercury 2Inception
8132.78s128k
36Step 3.7 FlashStepFun
4015.86s262k
37Ling 3.0 FlashInclusionAI
3947.12s262k
38Gemini 3.5 Flash-LiteGoogle
36510.33s1M
39LFM2.5-8B-A1BLiquidAI
3377.27s
40Nemotron 3 Nano Omni 30B A3BNVIDIA
3287.11s
41Gemini 3.1 Flash-LiteGoogle
3086.02s
42GPT-5.4 miniOpenAI
2013.85s
43Gemini 3 FlashGoogle
1770.81s
44Qwen3.5-35B-A3BAlibaba
15315.3s262k
45GLM-4.7-FlashZ.AI
9622.26s
46o3-miniOpenAI
1607.12s200k
47Qwen3.6-35B-A3BAlibaba
14838.68s262k
48Llama 4 ScoutMeta
1220.84s256k
49Command A+Cohere
18111.48s192k

💡 Wichtiger Unterschied

Cloud-APIs messen auf A100/H100 Servern — ihre tok/s sind 5–20× höher als lokal auf Strix Halo. Der Intelligence-Score von Artificial Analysis ist hardware-unabhängig und erlaubt fairen Vergleich.