HostYourAI Code

Code met open-weight modellen
in Europa.

Eén base-URL wisselen is genoeg.

Je houdt je tool, je wisselt het model: Claude Code, Cline en opencode blijven gewoon werken, maar de Claude-modellen erachter vervang je door open-weight modellen op Europese GPU's. Geen migratie, geen SDK-wissel. Betaal per token vanaf prepaid credits.

.zshrc · diff
- export ANTHROPIC_BASE_URL="https://api.anthropic.com"+ export ANTHROPIC_BASE_URL="https://hostyourai.com"+ export ANTHROPIC_AUTH_TOKEN="hyai-rt-..."+ export ANTHROPIC_MODEL="qwen3.6-27b-fp8"

De tool in je terminal blijft dezelfde. Wat wisselt: het model dat antwoordt, en de plek waar je code naartoe gaat.

Je code verlaat Europa niet Geverifieerd met een echte Claude Code-sessie
Werkt met >_Claude Code >_Cline >_opencode >_Anthropic SDK >_OpenAI SDK >_cURL
Drop-in

Twee API's, dezelfde router, dezelfde key

De router spreekt de Anthropic- én de OpenAI-API volledig. Je hoeft niets te herschrijven: elke tool of SDK die met één van beide praat, werkt direct.

ANTHROPIC API

Voor Claude Code en de Anthropic SDK

POST /v1/messages
POST /v1/messages/count_tokens
Token-voor-token streaming (SSE)
Tool calling: bestanden lezen, commando's draaien
x-api-key én Bearer auth
OPENAI API

Voor de OpenAI SDK en alles daaromheen

POST /v1/chat/completions
GET /v1/models met live context en tool-info
Token-voor-token streaming (SSE)
Tool calling (function calls)
Zelfde key en creditsaldo als de Anthropic-route
Geverifieerd

Getest met een echte sessie, niet met een demo

Voor we iets op deze pagina beloven, draaien we het zelf: een volledige Claude Code-sessie tegen deze router, die een bestand leest via tools en het juiste antwoord teruggeeft. Dit voorbeeld hiernaast is die test.

Eerlijk is eerlijk: de Amerikaanse topmodellen blijven beter. Dit is het alternatief voor wie code en prompts binnen Europa wil houden, met open gewichten die je zelf kunt controleren.

~/project · bash
$ claude > Lees hello.txt en vertel me wat de geheime code is. ● Read(hello.txt) De geheime code uit hello.txt is: KAAS-42
QQwen3.6 27B FP8tools32k · EU
+Volgende geverifieerde codeermodellenvolgt
Open gewichten

Open-weight modellen, eerlijk geserveerd

Geen black box: je weet welk model draait, met hoeveel context en welke tool-ondersteuning. Via GET /v1/models zie je live wat er geserveerd wordt. Verschijnt er een beter open codeermodel, dan verifiëren we het en komt het in de lijst.

Waarom EU

Gebouwd voor teams die niet alles naar de VS mogen sturen

Geen training op jouw code

Je prompts en code worden niet gebruikt om modellen te trainen. Wat je stuurt is van jou en blijft van jou.

Europese datacenters

Inference draait op GPU's in de EU. Je verkeer verlaat Europa niet, ook niet voor logging of analyse.

Verwerkersovereenkomst

Een DPA is beschikbaar voor teams die dit contractueel moeten vastleggen. Mail info@hostyourai.com.

Prijs

Per token, prepaid, nooit een rekening achteraf

Je laadt credits op vanaf €5 met iDEAL of kaart en betaalt per token, per model geprijsd. Op is op: je agent kan nooit meer uitgeven dan jij hebt klaargezet. Een middagje met een coding-agent kost typisch centen tot een paar euro.

Actuele tokenprijzen staan op de prijzenpagina.

IN DRIE MINUTEN AAN DE SLAG
1Maak een account en laad credits op
2Maak een router-key aan in het dashboard
3Zet de base-URL, key en het model in je shell
Start in het dashboard
FAQ

Eerlijke antwoorden

Gebruik ik dan nog Claude-modellen?

Nee. Claude Code is alleen de tool in je terminal; de Claude-modellen erachter vervang je door open-weight modellen zoals Qwen, gehost door ons in de EU. Je verkeer gaat niet meer naar Anthropic.

Moet ik mijn tooling aanpassen?

Nee. Alles wat de Anthropic- of OpenAI-API spreekt werkt door met een andere base-URL en key. Claude Code, Cline en opencode hebben genoeg aan drie omgevingsvariabelen.

Welk model krijg ik?

Nu een Qwen3.6-codeermodel met tools en 32k context, het beste open-weight model dat we geverifieerd hebben. De lijst groeit als er betere open modellen verschijnen.

Hoe snel is het?

Een warme GPU antwoordt vlot en streamt token voor token. Is het model koud, dan start je eerste vraag een GPU op en duurt het een paar minuten. Daarna blijft hij warm zolang je werkt.

Wat kost het?

Per token vanaf je prepaid creditsaldo. Een middagje met een coding-agent kost typisch centen tot een paar euro; elk request zie je live in je verbruik.

Zit ik ergens aan vast?

Nee. Geen abonnement; je laadt op wanneer jij wilt en je tegoed blijft staan. En omdat de API's standaard zijn, wissel je net zo makkelijk weer terug.

Wissel de base-URL en probeer het

Credits vanaf €5, geen abonnement. Je eerste sessie draait binnen een paar minuten.