Model garden Router · warm Dedicated · auf Anfrage

GLM 5V Turbo

Sofort über den EU-Router oder als dediziertes GPU-Deployment. Ihre Daten bleiben in Europa.

GLM 5V Turbo ist ein multimodales Sprachmodell von Z.AI mit einem Kontextfenster von 203K Tokens, gehostet auf europäischen GPUs über eine OpenAI-kompatible API.

zai-org/GLM-5V-Turbo
text+image->text · open weights · sovereign EU
Runs on EU infrastructure operated by European companies; US marketplace capacity is never part of this chain. Full chain
—
Parameter
203K
Kontextfenster
—
Minimaler VRAM
POST /api/v1/chat/completions 200 OK

Spezifikationen

Kontextfenster 202,752 tokens
Modalität text+image->text

Preise

Gemeinsamer Router · pro Token
€1.38
Input (pro 1M Tokens)
€4.60
Output (pro 1M Tokens)
€ 0,35 pro Million gecachter Input-Tokens
Dediziertes GPU · pro Stunde
Auf Anfrage
Dediziertes Deployment, ab — GB VRAM. Abrechnung nach GPU-Stunden.

Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.

Bench-Index

Bench ist unser Qualitätsindex für jedes Modell, 0 bis 100. Er stützt sich auf den Epoch AI Capabilities Index (rund 40 Benchmarks), ergänzt um LiveBench, und wird jeden Morgen aktualisiert.

55,3 / 100 · Über LiveBench

Aus dem LiveBench-Ergebnis auf dieselbe Skala umgerechnet.

Bandbreite 49,0 bis 61,6

Quellen: Epoch AI ↗ · LiveBench ↗ · Täglich aktualisiert, zuletzt am 25-09-2026

LiveBench · 49,6
Reasoning 56,1
Coding 73,9
Agentisches Coding 3,3
Mathematik 70,4
Datenanalyse 54,1
Sprache 62,3
Anweisungen befolgen 27,2
LiveBench · Alle Aufgaben
Reasoning
theory of mind 51,9
zebra puzzle 18,5
spatial 94,0
logic with navigation 60,0
Coding
code generation 76,1
code completion 71,7
Agentisches Coding
javascript 0,0
typescript 0,0
python 10,0
Mathematik
AMPS Hard 98,8
integrals with game 13,0
math comp 85,3
olympiad 84,5
Datenanalyse
consecutive events 20,9
tablejoin 43,5
tablereformat 98,0
Sprache
connections 86,0
plot unscrambling 46,8
typos 54,0
Anweisungen befolgen
paraphrase 22,8
simplify 25,9
story generation 28,4
summarize 31,7

Direkt aufrufen

Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "zai-org/GLM-5V-Turbo",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Häufig gestellte Fragen

Kann ich GLM 5V Turbo in der EU betreiben?

Ja. HostYourAI betreibt GLM 5V Turbo auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.

Ist das Hosting von GLM 5V Turbo DSGVO-konform?

Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.

Was kostet GLM 5V Turbo?

Über den gemeinsamen EU-Router zahlen Sie €1.38 pro Million Input-Tokens und €4.60 pro Million Output-Tokens, ohne Fixkosten. Für hohe Volumen oder Isolation können Sie GLM 5V Turbo auch als dedizierte GPU-Instanz stundenweise betreiben.

Ist die API OpenAI-kompatibel?

Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.

Weitere Modelle von MiniMaxAI

Testen Sie GLM 5V Turbo kostenlos

Die Kontoerstellung dauert eine Minute. Testen Sie GLM 5V Turbo direkt im Playground.

Kostenlos starten