Model garden Router · warm Dedicated · op aanvraag

GLM 5V Turbo

Direct via de EU-router of als dedicated GPU-deployment. Data blijft in Europa.

GLM 5V Turbo is een multimodaal taalmodel van Z.AI met een contextvenster van 203K tokens, gehost op Europese GPU's via een OpenAI-compatibele API.

zai-org/GLM-5V-Turbo
text+image->text · open weights · sovereign EU
Runs on EU infrastructure operated by European companies; US marketplace capacity is never part of this chain. Full chain
—
Parameters
203K
Contextvenster
—
Minimale VRAM
POST /api/v1/chat/completions 200 OK

Specificaties

Contextvenster 202,752 tokens
Modaliteit text+image->text

Prijzen

Gedeelde router · per token
€1.38
Input (per 1M tokens)
€4.60
Output (per 1M tokens)
€ 0,35 per miljoen gecachte input-tokens
Dedicated GPU · per uur
Op aanvraag
Dedicated deployment, vanaf — GB VRAM. Afgerekend per GPU-uur.

Gedeelde EU-router, pay-per-token, scale-to-zero. Dedicated GPU-deployments worden per uur afgerekend, zie prijzen.

Bench-index

Bench is onze kwaliteitsindex voor elk model, 0 tot 100. Hij steunt op de Epoch AI Capabilities Index (zo’n 40 benchmarks), aangevuld met LiveBench, en wordt elke ochtend ververst.

55,3 / 100 · Via LiveBench

Omgerekend uit het LiveBench-resultaat naar dezelfde schaal.

Bandbreedte 49,0 tot 61,6

Bronnen: Epoch AI ↗ · LiveBench ↗ · Dagelijks bijgewerkt, laatst op 25-09-2026

LiveBench · 49,6
Redeneren 56,1
Code 73,9
Agentisch coderen 3,3
Wiskunde 70,4
Data-analyse 54,1
Taal 62,3
Instructies volgen 27,2
LiveBench · Alle taken
Redeneren
theory of mind 51,9
zebra puzzle 18,5
spatial 94,0
logic with navigation 60,0
Code
code generation 76,1
code completion 71,7
Agentisch coderen
javascript 0,0
typescript 0,0
python 10,0
Wiskunde
AMPS Hard 98,8
integrals with game 13,0
math comp 85,3
olympiad 84,5
Data-analyse
consecutive events 20,9
tablejoin 43,5
tablereformat 98,0
Taal
connections 86,0
plot unscrambling 46,8
typos 54,0
Instructies volgen
paraphrase 22,8
simplify 25,9
story generation 28,4
summarize 31,7

Direct aanroepen

Drop-in vervanger voor OpenAI: wijzig alleen de base-URL en de API-key. Ook het Anthropic-formaat (/v1/messages) wordt ondersteund.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "zai-org/GLM-5V-Turbo",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Veelgestelde vragen

Kan ik GLM 5V Turbo in de EU draaien?

Ja. HostYourAI draait GLM 5V Turbo op GPU's in Europese datacenters via vLLM. Prompts en outputs verlaten de EU niet en er is geen Amerikaanse cloudprovider in de keten.

Is GLM 5V Turbo hosten AVG/GDPR-compliant?

Ja. Alle verwerking vindt plaats binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open-source gewichten betekenen ook: geen training op jouw data.

Wat kost GLM 5V Turbo?

Via de gedeelde EU-router betaal je €1.38 per miljoen input-tokens en €4.60 per miljoen output-tokens, zonder vaste kosten. Voor hoge volumes of isolatie kun je GLM 5V Turbo ook als dedicated GPU-instance per uur draaien.

Is de API compatibel met OpenAI?

Ja. Je gebruikt de standaard OpenAI-SDK's met een aangepaste base-URL (https://hostyourai.com/api/v1). Ook de Anthropic Messages API wordt ondersteund als drop-in.

Andere modellen van MiniMaxAI

Probeer GLM 5V Turbo gratis

Account aanmaken duurt een minuut. Test GLM 5V Turbo direct in de playground.

Start gratis