Rankings

Modell-Rankings

Offene Modelle, geordnet nach Intelligenz und Geschwindigkeit, gehostet auf GPUs in der EU.

Bench: gemessene Qualität unserer Modelle

Die 50 besten Modelle, die wir hosten, nur gemessene Werte (Epoch AI, oder LiveBench und LMArena auf dieselbe Skala umgerechnet); Schätzungen stehen nicht in der Rangliste.

# Modell Quelle Bandbreite LiveBench Bench
1
Moonshotai
Gemessen 81.2-88.0 79.2
84.5
2
Z.AI
Gemessen 79.6-85.4 76.1
82.2
3 Gemessen 79.6-84.5 77.4
81.7
4 Gemessen 73.5-84.5 81.1
81.3
5 Über LiveBench 72.7-85.3 78.5
79.0
6 Über LiveBench 71.3-83.9 76.8
77.6
7 Gemessen 74.2-80.4 71.6
77.4
8 Über LiveBench 70.8-83.5 76.2
77.2
9
Z.AI
Gemessen 74.8-79.9 73.2
77.2
10
Moonshotai
Gemessen 73.9-78.5 70.5
76.3
11
Moonshotai
Gemessen 72.6-77.2 68.4
75.0
12
Z.AI
Gemessen 72.5-77.0 70.2
74.9
13 Gemessen 71.8-77.0 75.3
74.3
14
DeepSeek
Gemessen 71.8-76.2 71.6
73.9
15
Moonshotai
Gemessen 70.6-74.2 69.1
72.6
16
MiniMaxAI
Gemessen 65.9-74.8 67.3
71.3
17
MiniMaxAI
Gemessen 65.3-72.4 60.2
70.9
18
Qwen3.5-397b-a17b
Gemessen 68.5-72.7 —
70.8
19 Gemessen 67.8-72.4 64.0
70.6
20
DeepSeek
Gemessen 68.0-71.9 51.8
70.3
21 Gemessen 67.0-72.4 74.2
70.1
22
Moonshotai
Gemessen 66.7-72.0 61.6
70.0
23
Google
Über LMArena 63.8-76.0 —
69.9
24
Z.AI
Gemessen 67.4-72.1 68.9
69.8
25 Gemessen 65.5-71.6 49.9
68.8
26
Z.AI
Über LiveBench 61.7-74.3 65.0
68.0
27 Über LiveBench 61.4-74.0 64.7
67.7
28 Gemessen 64.0-70.0 —
67.4
29 Über LMArena 60.8-73.0 —
66.9
30
Z.AI
Gemessen 64.1-69.5 58.1
66.9
31 Über LMArena 60.4-72.6 —
66.5
32 Über LMArena 60.4-72.6 —
66.5
33
Google
Gemessen 62.8-68.7 61.6
65.9
34 Gemessen 62.7-68.4 —
65.7
35
Qwen
Über LMArena 59.4-71.6 —
65.5
36 Über LMArena 59.4-71.6 —
65.5
37 Über LMArena 59.4-71.6 —
65.5
38 Gemessen 60.5-66.7 —
64.8
39 Über LiveBench 58.0-70.6 60.5
64.3
40
DeepSeek
Gemessen 61.0-66.0 69.4
64.1
41
Moonshotai
Gemessen 58.8-65.4 48.1
62.7
42
Gpt-oss-120b
Gemessen 56.6-65.3 46.1
62.4
43
DeepSeek
Gemessen 57.6-66.7 —
62.4
44
Qwen
Gemessen 58.1-64.2 —
61.8
45 Gemessen 56.5-63.5 63.4
61.7
46
DeepSeek
Gemessen 57.8-63.0 72.7
61.2
47
Qwen3-235b-a22b-instruct-2507
Gemessen 57.2-63.2 48.8
61.2
48 Über LiveBench 54.8-67.4 56.6
61.1
49
Qwen
Gemessen 56.3-63.0 43.6
60.6
50
Qwen
Gemessen 54.4-62.7 68.2
60.3

Quellen: Epoch AI und LMArena (CC BY 4.0), LiveBench. Jeden Morgen aktualisiert. epoch.ai ↗

Intelligenz-Rangliste

Geordnet nach einem zusammengesetzten Index öffentlich berichteter Benchmarks. Höher ist besser.

# Modell Größe MMLUGPQAMATHCode Index
1
DeepSeek
— 91.4 81.0 97.0 92.0
90.4
2
Gpt-oss-120b
— — 80.1 97.9 —
89.0
3
DeepSeek
— 90.8 71.5 97.3 90.0
87.4
4
Z.AI
— 85.5 82.0 93.5 —
87.0
5
Z.AI
— 84.6 79.1 91.0 —
84.9
6 32B 83.3 — 83.1 88.4
84.9
7
OpenAI
21B — 71.5 96.0 —
83.8
8 235B 87.8 71.1 92.2 —
83.7
9
DeepSeek
— 90.0 67.0 92.0 85.0
83.5
10 685B 89.5 62.7 91.6 84.0
82.0
11 110B 81.0 75.0 89.0 —
81.7
12 14B 79.7 — 80.0 83.5
81.1
13
DeepSeek
— 88.5 59.1 90.2 82.6
80.1
14 70B — 65.2 94.5 —
79.9
15
Qwen
32B 82.4 68.4 88.5 —
79.8
16 32B — 62.1 94.3 —
78.2
17
Qwen
14B 80.7 65.8 87.7 —
78.1
18 30B 79.5 65.8 86.6 —
77.3
19 14B — 59.1 93.9 —
76.5
20 72B 86.1 49.0 83.1 86.6
76.2
21
Microsoft
14B 84.8 56.1 80.4 82.6
76.0
22 70B 86.0 50.5 77.0 88.4
75.5
23 405B 87.3 50.7 73.8 89.0
75.2
24 32B — — 57.2 92.7
75.0
25
Qwen
8B 76.9 62.0 85.0 —
74.6
26 7B — — 57.2 88.4
72.8
27 7.6B — 49.1 92.8 —
71.0
28 70B 83.6 41.7 68.0 80.5
68.5
29
Qwen
7B 74.2 36.4 75.5 84.8
67.7
30
Microsoft
3.8B 67.3 — 64.0 —
65.7
31
Google
27B — 42.4 89.0 —
65.7
32
Google
12B — 34.9 83.8 —
59.4
33 27B 75.2 — 42.3 —
58.8
34 3.8B 69.0 — 48.5 —
58.8
35 8B 69.4 30.4 51.9 72.6
56.1
36 3B 63.4 — 48.0 —
55.7
37
Google
9.2B 71.3 — 36.6 —
54.0
38
Google
4B — 30.8 75.6 —
53.2
39
Mistral
12B 68.0 — 38.0 —
53.0
40 1B 49.3 — 30.6 —
40.0
41 7.2B 60.1 — 11.2 30.5
33.9

Benchmarks sind öffentlich berichtete Zahlen der Modellhersteller und offener Leaderboards (zuletzt aktualisiert 2026-06). Die Methodik unterscheidet sich je nach Modell, der Index ist daher eine Ordnungshilfe, kein kontrollierter Benchmark.

Geschwindigkeits-Rangliste

Geordnet nach der realen Antwortzeit, die wir auf unseren eigenen EU-GPUs gemessen haben. Niedriger ist besser.

# Modell Größe Antwortzeit
1
Google
2.5B 66 ms
2 3.2B 76 ms
3 6.2B 81 ms
4 1.5B 81 ms
5 3.8B 81 ms
6 3.8B 82 ms
7 3B 83 ms
8 1.2B 87 ms
9 8B 89 ms
10 2.1B 93 ms
11 4.1B 93 ms
12 6.2B 94 ms
13
Qwen
2B 96 ms
14 0.9B 96 ms
15 15B 98 ms
16
Microsoft
15B 98 ms
17 8.3B 101 ms
18 7.8B 103 ms
19 3.8B 103 ms
20
Microsoft
8.3B 106 ms
21
LumiOpen
8B 109 ms
22 23B 109 ms
23
Utter-project
2.1B 110 ms
24
HostYourAI
22B 111 ms
25 3.8B 115 ms

Die Antwortzeiten wurden bei unserer letzten Verifizierung des jeweiligen Modells gemessen und variieren mit Auslastung und Kaltstarts.

Hosten. Routen. Ausliefern.

Keine Kreditkarte nötig. Pay as you go, jederzeit kündbar.

Heute kostenlos starten