GPU & infra

Claude Code, Cline en opencode op Europese GPU's, per token vanaf prepaid credits

HostYourAI Code: draai coding-agents zoals Claude Code op EU-gehoste open modellen. Betaal per token vanaf prepaid credits, met tools, streaming en live verbruiksinzicht.

qwen3-8b vLLM ready
NVIDIA A100 · 40GB · EU marketplace · eu-central
VRAM19.2 / 40 GB
GPU utilisation71%
42 ms
time-to-first-token
128
tokens / sec
62°C
temperature
POST /api/v1/chat/completions200 OK

Wat is HostYourAI Code?

HostYourAI Code laat coding-agents zoals Claude Code, Cline en opencode werken op open modellen op Europese GPU's. Je agent praat met onze router via de Anthropic- of OpenAI-API en je betaalt per token vanaf je eigen prepaid creditsaldo. Geen abonnement, geen verrassingen: op is op.

python
from openai import OpenAI
client = OpenAI(
    base_url="https://hostyourai.com/api/v1",
    api_key="hyai-...")
client.chat.completions.create(
    model="llama-3.3-70b",
    messages=[{"role":"user","content":"Hallo!"}])

Waarom prepaid credits?

Coding-agents doen veel verzoeken: elke vraag in je terminal is een reeks API-calls met een groot system prompt. Met prepaid credits weet je zeker dat je agent nooit meer kan uitgeven dan jij hebt klaargezet, en je ziet elk request live terug in je verbruik. Opladen kan vanaf 5 euro met iDEAL of kaart.

EU Inference Router

‹ Insight 1 of 28 ›
98.7% ↗ 12%
4,931 of 5,000 requests served warm
EU-hostedModels run on European GPUs
Drop-inOpenAI and Anthropic compatible
Scale to zeroGPUs idle when nobody is online

Zo sluit je Claude Code aan

Maak een account, laad credits op en maak een router-key aan in het dashboard. Daarna:

export ANTHROPIC_BASE_URL="https://hostyourai.com"
export ANTHROPIC_AUTH_TOKEN="hyai-rt-..."
export ANTHROPIC_MODEL="qwen3.6-27b-fp8"
export ANTHROPIC_SMALL_FAST_MODEL="qwen3.6-27b-fp8"
claude

Cline en opencode stel je op dezelfde manier in: base-URL naar HostYourAI, je eigen key en het codeermodel. Via GET /v1/models zie je per model of tools ondersteund worden en hoeveel context er op dit moment geserveerd wordt.

One-click deployment
OpenAI-compatible API
4 EU datacenters
End-to-end encryptie
Dedicated GPU instances
Audit logging

Wat krijg je?

  • Een geverifieerd codeermodel met tool-ondersteuning en 32k context, afgerekend per token
  • Tool calling en token-voor-token streaming via de Anthropic- én OpenAI-API
  • EU-hosting: je prompts en code verlaten Europa niet, en er wordt niet getraind op jouw data
  • Live verbruiksinzicht per request in het dashboard
  • Geen abonnement: je tegoed blijft staan en elke uitgave stopt zodra jij stopt

EU Inference Router

‹ Insight 1 of 28 ›
98.7% ↗ 12%
4,931 of 5,000 requests served warm
EU-hostedModels run on European GPUs
Drop-inOpenAI and Anthropic compatible
Scale to zeroGPUs idle when nobody is online

Eerlijk over de grenzen

Is het model koud, dan start je eerste vraag een GPU op en duurt het een paar minuten voor je antwoord komt; daarna blijft hij warm zolang je werkt. De topmodellen van Anthropic zelf zijn beter dan open modellen; dit is het alternatief voor wie code en prompts binnen Europa wil houden. Vragen over volumes of een vaste prijs? Mail naar info@hostyourai.com.

je vraag
doc-4f2a0.94
doc-9c1e0.91
doc-2b770.88

Vragen over HostYourAI Code

Welke modellen krijg ik?

De actuele lijst staat in GET /v1/models en het dashboard. We kiezen modellen met tool-ondersteuning die goed zijn in code, en vernieuwen die lijst als er betere open modellen verschijnen.

Werkt dit echt met Claude Code?

Ja, de router spreekt de Anthropic-API inclusief tools, streaming en count_tokens, en we verifiëren dat met echte Claude Code-sessies. Zie ook de Anthropic-compatibele API.

Gebruik ik dan nog Claude-modellen?

Nee. Claude Code is alleen de tool in je terminal; de Claude-modellen erachter vervang je door open-weight modellen zoals Qwen, gehost door ons in de EU. Je verkeer gaat niet meer naar Anthropic.

Wat kost het?

Per token, per model geprijsd, vanaf je prepaid saldo. Een middagje werken met een agent kost typisch centen tot een paar euro. Zie de prijzenpagina.

Zit ik ergens aan vast?

Nee. Geen abonnement; je laadt op wanneer jij wilt en je tegoed blijft gewoon staan.

Waar draait mijn code?

Op GPU's in Europese datacenters. Er is een verwerkersovereenkomst beschikbaar en er wordt niet getraind op jouw data.

Je app
OpenAI · Anthropic
EU Router
één base URL
Qwen3-8B
warm
Loes (NL)
soeverein
Llama-3.3
warm

Alles wat je nodig hebt voor AI

Van model-hosting tot een klantgerichte API, gebouwd voor developers en bedrijven die hun AI op infrastructuur willen draaien die ze echt beheren, binnen de EU.

100%
EU-gehost

Je data en je modellen blijven op Europese GPUs. GDPR-vriendelijk vanaf de basis.

200+
Geverifieerde modellen, klaar om te serveren

Llama, Qwen, DeepSeek, Mistral, FLUX en nog veel meer. Kies er een en hij is binnen minuten warm, zonder DevOps aan jouw kant.

2 SDK
OpenAI- en Anthropic-compatibel

Richt je bestaande client op de Router en behoud je tools. Geen herschrijven, geen lock-in.

Van nul naar een warm endpoint in minuten

Geen infra om te beheren. Kies een model, krijg een OpenAI-compatibele URL, ship.

1

Kies een model

Kies uit de Model Garden of plak een willekeurig HuggingFace-ID. Stel de VRAM in en kies een EU-GPU.

2

Krijg je endpoint

Wij deployen vLLM, draaien readiness-probes en geven je een warme OpenAI- en Anthropic-compatibele URL plus een API-key.

3

Route en ship

Richt je client op de Router. Die routeert automatisch naar een warme instance, zet GPUs idle als niemand online is en logt elk verzoek.

Gebouwd voor teams die data niet mogen wegsturen

Als een Amerikaanse cloud geen optie is, geeft HostYourAI je dezelfde developer-ervaring op Europese infrastructuur.

Overheid & publieke sector

Burgerdata die wettelijk in de EU moet blijven, volledig auditeerbaar.

Gereguleerde enterprise

Finance-, zorg- en juridische teams onder GDPR, DORA en de AI Act.

EU SaaS & scale-ups

Lever AI-functies waar je klanten op vertrouwen, zonder Amerikaanse sub-processor.

Agencies & integrators

Lever privé-AI voor klanten op infrastructuur waar je achter kunt staan.

Privé vanaf de basis

HostYourAI houdt je modellen, prompts en data op Europese GPUs. Gebouwd voor teams die geven om compliance, betrouwbaarheid en echte controle.

EU-gehostAVG-vriendelijkOpenAI-compatibelvLLMGeen lock-in
EU
Volledige datasoevereiniteit

GPU's en data binnen Europa. Je prompts verlaten de EU nooit.

Open
Modellen die je kunt auditen

Draai open-weight modellen zonder black boxes of verborgen telemetrie.

€0
Scale-to-zero

GPU's idlen als niemand online is, dus je betaalt alleen voor wat je draait.

Jouw
Geen vendor lock-in

Jouw infra, jouw keys, jouw modellen. Vertrek wanneer je wilt.

Veelgestelde vragen

Kan ik dit in de EU draaien?

Ja. HostYourAI draait open modellen op GPU's in Europese datacenters via vLLM. Je prompts en outputs verlaten de EU niet en er zit geen Amerikaanse cloudprovider in de keten.

Is het AVG/GDPR-compliant?

Ja. Alle verwerking gebeurt binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open gewichten betekenen ook: geen training op jouw data.

Is de API compatibel met OpenAI?

Ja. Je richt je bestaande OpenAI- of Anthropic-client op onze Router (https://hostyourai.com/api/v1), alleen de base-URL en API-key wijzigen. Geen rewrite, geen lock-in.

Wat kost het?

Pay-as-you-go met één prepaid creditsaldo: de gedeelde router per token of een dedicated GPU per uur. Gratis te starten, geen minimum, geen vaste maandkosten.

Model garden

Werkt met 390+ open modellen

Tekst- en beeldmodellen op dedicated EU GPU's. Elk model getest op onze eigen hardware.

Ook interessant

Verken meer over EU-gehoste AI op HostYourAI.

Host. Route. Ship.

Geen creditcard nodig. Betaal naar gebruik, stop wanneer je wilt.

Begin vandaag gratis met hosten