Model garden Router · warm Dedicated · auf Anfrage

GLM 5 Turbo

Sofort über den EU-Router oder als dediziertes GPU-Deployment. Ihre Daten bleiben in Europa.

GLM 5 Turbo ist ein quelloffenes Sprachmodell von Z.AI mit einem Kontextfenster von 203K Tokens, gehostet auf europäischen GPUs über eine OpenAI-kompatible API.

zai-org/GLM-5-Turbo
text->text · open weights · sovereign EU
Runs on EU infrastructure operated by European companies; US marketplace capacity is never part of this chain. Full chain
—
Parameter
203K
Kontextfenster
—
Minimaler VRAM
POST /api/v1/chat/completions 200 OK

Spezifikationen

Kontextfenster 202,752 tokens
Modalität text->text

Preise

Gemeinsamer Router · pro Token
€1.38
Input (pro 1M Tokens)
€4.60
Output (pro 1M Tokens)
€ 0,35 pro Million gecachter Input-Tokens
Dediziertes GPU · pro Stunde
Auf Anfrage
Dediziertes Deployment, ab — GB VRAM. Abrechnung nach GPU-Stunden.

Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.

Bench-Index

Bench ist unser Qualitätsindex für jedes Modell, 0 bis 100. Er stützt sich auf den Epoch AI Capabilities Index (rund 40 Benchmarks), ergänzt um LiveBench, und wird jeden Morgen aktualisiert.

~52,8 / 100 · Grobe Schätzung

Keine öffentliche Messung und keine bekannte Größe: der typische Wert dieser Modellart, mit breiter Bandbreite. Ein Platzhalter, keine Messung.

Bandbreite 23,2 bis 74,2

Quellen: Epoch AI ↗ · LiveBench ↗ · LMArena ↗ · Täglich aktualisiert, zuletzt am 26-09-2026

Keine öffentliche Messung und keine bekannte Größe: der typische Wert dieser Modellart, mit breiter Bandbreite. Ein Platzhalter, keine Messung.

Direkt aufrufen

Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "zai-org/GLM-5-Turbo",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Häufig gestellte Fragen

Kann ich GLM 5 Turbo in der EU betreiben?

Ja. HostYourAI betreibt GLM 5 Turbo auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.

Ist das Hosting von GLM 5 Turbo DSGVO-konform?

Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.

Was kostet GLM 5 Turbo?

Über den gemeinsamen EU-Router zahlen Sie €1.38 pro Million Input-Tokens und €4.60 pro Million Output-Tokens, ohne Fixkosten. Für hohe Volumen oder Isolation können Sie GLM 5 Turbo auch als dedizierte GPU-Instanz stundenweise betreiben.

Ist die API OpenAI-kompatibel?

Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.

Weitere Modelle von Mistral-small-4-119b

Testen Sie GLM 5 Turbo kostenlos

Die Kontoerstellung dauert eine Minute. Testen Sie GLM 5 Turbo direkt im Playground.

Kostenlos starten