Offene Modelle, geordnet nach Intelligenz und Geschwindigkeit, gehostet auf GPUs in der EU.
Die 50 besten Modelle, die wir hosten, nur gemessene Werte (Epoch AI, oder LiveBench und LMArena auf dieselbe Skala umgerechnet); Schätzungen stehen nicht in der Rangliste.
| # | Modell | Quelle | Bandbreite | LiveBench | Bench |
|---|---|---|---|---|---|
| 1 |
Moonshotai
|
Gemessen | 81.2-88.0 | 79.2 |
84.5
|
| 2 |
Z.AI
|
Gemessen | 79.6-85.4 | 76.1 |
82.2
|
| 3 |
DeepSeek
|
Gemessen | 79.6-84.5 | 77.4 |
81.7
|
| 4 |
DeepSeek
|
Gemessen | 73.5-84.5 | 81.1 |
81.3
|
| 5 |
Qwen
|
Über LiveBench | 72.7-85.3 | 78.5 |
79.0
|
| 6 |
DeepSeek
|
Über LiveBench | 71.3-83.9 | 76.8 |
77.6
|
| 7 |
Z.AI
|
Gemessen | 74.2-80.4 | 71.6 |
77.4
|
| 8 |
Qwen
|
Über LiveBench | 70.8-83.5 | 76.2 |
77.2
|
| 9 |
Z.AI
|
Gemessen | 74.8-79.9 | 73.2 |
77.2
|
| 10 |
Moonshotai
|
Gemessen | 73.9-78.5 | 70.5 |
76.3
|
| 11 |
Moonshotai
|
Gemessen | 72.6-77.2 | 68.4 |
75.0
|
| 12 |
Z.AI
|
Gemessen | 72.5-77.0 | 70.2 |
74.9
|
| 13 |
Qwen
|
Gemessen | 71.8-77.0 | 75.3 |
74.3
|
| 14 |
DeepSeek
|
Gemessen | 71.8-76.2 | 71.6 |
73.9
|
| 15 |
Moonshotai
|
Gemessen | 70.6-74.2 | 69.1 |
72.6
|
| 16 |
MiniMaxAI
|
Gemessen | 65.9-74.8 | 67.3 |
71.3
|
| 17 |
MiniMaxAI
|
Gemessen | 65.3-72.4 | 60.2 |
70.9
|
| 18 |
Qwen3.5-397b-a17b
|
Gemessen | 68.5-72.7 | — |
70.8
|
| 19 |
Qwen
|
Gemessen | 67.8-72.4 | 64.0 |
70.6
|
| 20 |
DeepSeek
|
Gemessen | 68.0-71.9 | 51.8 |
70.3
|
| 21 |
DeepSeek
|
Gemessen | 67.0-72.4 | 74.2 |
70.1
|
| 22 |
Moonshotai
|
Gemessen | 66.7-72.0 | 61.6 |
70.0
|
| 23 |
Google
|
Über LMArena | 63.8-76.0 | — |
69.9
|
| 24 |
Z.AI
|
Gemessen | 67.4-72.1 | 68.9 |
69.8
|
| 25 |
DeepSeek
|
Gemessen | 65.5-71.6 | 49.9 |
68.8
|
| 26 |
Z.AI
|
Über LiveBench | 61.7-74.3 | 65.0 |
68.0
|
| 27 |
DeepSeek
|
Über LiveBench | 61.4-74.0 | 64.7 |
67.7
|
| 28 |
Qwen
|
Gemessen | 64.0-70.0 | — |
67.4
|
| 29 | Über LMArena | 60.8-73.0 | — |
66.9
|
|
| 30 |
Z.AI
|
Gemessen | 64.1-69.5 | 58.1 |
66.9
|
| 31 |
Qwen
|
Über LMArena | 60.4-72.6 | — |
66.5
|
| 32 |
Qwen
|
Über LMArena | 60.4-72.6 | — |
66.5
|
| 33 |
Google
|
Gemessen | 62.8-68.7 | 61.6 |
65.9
|
| 34 |
Qwen
|
Gemessen | 62.7-68.4 | — |
65.7
|
| 35 |
Qwen
|
Über LMArena | 59.4-71.6 | — |
65.5
|
| 36 |
Qwen
|
Über LMArena | 59.4-71.6 | — |
65.5
|
| 37 |
Qwen
|
Über LMArena | 59.4-71.6 | — |
65.5
|
| 38 |
Google
|
Gemessen | 60.5-66.7 | — |
64.8
|
| 39 |
Z.AI
|
Über LiveBench | 58.0-70.6 | 60.5 |
64.3
|
| 40 |
DeepSeek
|
Gemessen | 61.0-66.0 | 69.4 |
64.1
|
| 41 |
Moonshotai
|
Gemessen | 58.8-65.4 | 48.1 |
62.7
|
| 42 |
Gpt-oss-120b
|
Gemessen | 56.6-65.3 | 46.1 |
62.4
|
| 43 |
DeepSeek
|
Gemessen | 57.6-66.7 | — |
62.4
|
| 44 |
Qwen
|
Gemessen | 58.1-64.2 | — |
61.8
|
| 45 |
Qwen
|
Gemessen | 56.5-63.5 | 63.4 |
61.7
|
| 46 |
DeepSeek
|
Gemessen | 57.8-63.0 | 72.7 |
61.2
|
| 47 |
Qwen3-235b-a22b-instruct-2507
|
Gemessen | 57.2-63.2 | 48.8 |
61.2
|
| 48 |
Microsoft
|
Über LiveBench | 54.8-67.4 | 56.6 |
61.1
|
| 49 |
Qwen
|
Gemessen | 56.3-63.0 | 43.6 |
60.6
|
| 50 |
Qwen
|
Gemessen | 54.4-62.7 | 68.2 |
60.3
|
Quellen: Epoch AI und LMArena (CC BY 4.0), LiveBench. Jeden Morgen aktualisiert. epoch.ai ↗
Geordnet nach einem zusammengesetzten Index öffentlich berichteter Benchmarks. Höher ist besser.
| # | Modell | Größe | MMLU | GPQA | MATH | Code | Index |
|---|---|---|---|---|---|---|---|
| 1 |
DeepSeek
|
— | 91.4 | 81.0 | 97.0 | 92.0 |
90.4
|
| 2 |
Gpt-oss-120b
|
— | — | 80.1 | 97.9 | — |
89.0
|
| 3 |
DeepSeek
|
— | 90.8 | 71.5 | 97.3 | 90.0 |
87.4
|
| 4 |
Z.AI
|
— | 85.5 | 82.0 | 93.5 | — |
87.0
|
| 5 |
Z.AI
|
— | 84.6 | 79.1 | 91.0 | — |
84.9
|
| 6 |
Qwen
|
32B | 83.3 | — | 83.1 | 88.4 |
84.9
|
| 7 |
OpenAI
|
21B | — | 71.5 | 96.0 | — |
83.8
|
| 8 |
Qwen
|
235B | 87.8 | 71.1 | 92.2 | — |
83.7
|
| 9 |
DeepSeek
|
— | 90.0 | 67.0 | 92.0 | 85.0 |
83.5
|
| 10 |
DeepSeek
|
685B | 89.5 | 62.7 | 91.6 | 84.0 |
82.0
|
| 11 |
Z.AI
|
110B | 81.0 | 75.0 | 89.0 | — |
81.7
|
| 12 |
Qwen
|
14B | 79.7 | — | 80.0 | 83.5 |
81.1
|
| 13 |
DeepSeek
|
— | 88.5 | 59.1 | 90.2 | 82.6 |
80.1
|
| 14 |
DeepSeek
|
70B | — | 65.2 | 94.5 | — |
79.9
|
| 15 |
Qwen
|
32B | 82.4 | 68.4 | 88.5 | — |
79.8
|
| 16 |
DeepSeek
|
32B | — | 62.1 | 94.3 | — |
78.2
|
| 17 |
Qwen
|
14B | 80.7 | 65.8 | 87.7 | — |
78.1
|
| 18 |
Qwen
|
30B | 79.5 | 65.8 | 86.6 | — |
77.3
|
| 19 |
DeepSeek
|
14B | — | 59.1 | 93.9 | — |
76.5
|
| 20 |
Qwen
|
72B | 86.1 | 49.0 | 83.1 | 86.6 |
76.2
|
| 21 |
Microsoft
|
14B | 84.8 | 56.1 | 80.4 | 82.6 |
76.0
|
| 22 |
Meta
|
70B | 86.0 | 50.5 | 77.0 | 88.4 |
75.5
|
| 23 | 405B | 87.3 | 50.7 | 73.8 | 89.0 |
75.2
|
|
| 24 |
Qwen
|
32B | — | — | 57.2 | 92.7 |
75.0
|
| 25 |
Qwen
|
8B | 76.9 | 62.0 | 85.0 | — |
74.6
|
| 26 |
Qwen
|
7B | — | — | 57.2 | 88.4 |
72.8
|
| 27 |
DeepSeek
|
7.6B | — | 49.1 | 92.8 | — |
71.0
|
| 28 |
Meta
|
70B | 83.6 | 41.7 | 68.0 | 80.5 |
68.5
|
| 29 |
Qwen
|
7B | 74.2 | 36.4 | 75.5 | 84.8 |
67.7
|
| 30 |
Microsoft
|
3.8B | 67.3 | — | 64.0 | — |
65.7
|
| 31 |
Google
|
27B | — | 42.4 | 89.0 | — |
65.7
|
| 32 |
Google
|
12B | — | 34.9 | 83.8 | — |
59.4
|
| 33 |
Google
|
27B | 75.2 | — | 42.3 | — |
58.8
|
| 34 |
Microsoft
|
3.8B | 69.0 | — | 48.5 | — |
58.8
|
| 35 |
Meta
|
8B | 69.4 | 30.4 | 51.9 | 72.6 |
56.1
|
| 36 |
Meta
|
3B | 63.4 | — | 48.0 | — |
55.7
|
| 37 |
Google
|
9.2B | 71.3 | — | 36.6 | — |
54.0
|
| 38 |
Google
|
4B | — | 30.8 | 75.6 | — |
53.2
|
| 39 |
Mistral
|
12B | 68.0 | — | 38.0 | — |
53.0
|
| 40 |
Meta
|
1B | 49.3 | — | 30.6 | — |
40.0
|
| 41 |
Mistral
|
7.2B | 60.1 | — | 11.2 | 30.5 |
33.9
|
Benchmarks sind öffentlich berichtete Zahlen der Modellhersteller und offener Leaderboards (zuletzt aktualisiert 2026-06). Die Methodik unterscheidet sich je nach Modell, der Index ist daher eine Ordnungshilfe, kein kontrollierter Benchmark.
Geordnet nach der realen Antwortzeit, die wir auf unseren eigenen EU-GPUs gemessen haben. Niedriger ist besser.
| # | Modell | Größe | Antwortzeit |
|---|---|---|---|
| 1 |
Google
|
2.5B | 66 ms |
| 2 | 3.2B | 76 ms | |
| 3 |
BSC-LT
|
6.2B | 81 ms |
| 4 |
Swiss-ai
|
1.5B | 81 ms |
| 5 |
Microsoft
|
3.8B | 81 ms |
| 6 |
Microsoft
|
3.8B | 82 ms |
| 7 |
Ibm-granite
|
3B | 83 ms |
| 8 | 1.2B | 87 ms | |
| 9 | 8B | 89 ms | |
| 10 |
Qwen
|
2.1B | 93 ms |
| 11 |
Microsoft
|
4.1B | 93 ms |
| 12 |
BSC-LT
|
6.2B | 94 ms |
| 13 |
Qwen
|
2B | 96 ms |
| 14 |
Qwen
|
0.9B | 96 ms |
| 15 |
Qwen
|
15B | 98 ms |
| 16 |
Microsoft
|
15B | 98 ms |
| 17 |
NVIDIA
|
8.3B | 101 ms |
| 18 |
BSC-LT
|
7.8B | 103 ms |
| 19 |
Microsoft
|
3.8B | 103 ms |
| 20 |
Microsoft
|
8.3B | 106 ms |
| 21 |
LumiOpen
|
8B | 109 ms |
| 22 |
Utter-project
|
23B | 109 ms |
| 23 |
Utter-project
|
2.1B | 110 ms |
| 24 |
Loes EUEU
HostYourAI
|
22B | 111 ms |
| 25 |
Swiss-ai
|
3.8B | 115 ms |
Die Antwortzeiten wurden bei unserer letzten Verifizierung des jeweiligen Modells gemessen und variieren mit Auslastung und Kaltstarts.
Keine Kreditkarte nötig. Pay as you go, jederzeit kündbar.
Heute kostenlos starten