Eén base-URL wisselen is genoeg.
Je houdt je tool, je wisselt het model: Claude Code, Cline en opencode blijven gewoon werken, maar de Claude-modellen erachter vervang je door open-weight modellen op Europese GPU's. Geen migratie, geen SDK-wissel. Betaal per token vanaf prepaid credits.
De tool in je terminal blijft dezelfde. Wat wisselt: het model dat antwoordt, en de plek waar je code naartoe gaat.
De router spreekt de Anthropic- én de OpenAI-API volledig. Je hoeft niets te herschrijven: elke tool of SDK die met één van beide praat, werkt direct.
Voor we iets op deze pagina beloven, draaien we het zelf: een volledige Claude Code-sessie tegen deze router, die een bestand leest via tools en het juiste antwoord teruggeeft. Dit voorbeeld hiernaast is die test.
Eerlijk is eerlijk: de Amerikaanse topmodellen blijven beter. Dit is het alternatief voor wie code en prompts binnen Europa wil houden, met open gewichten die je zelf kunt controleren.
Geen black box: je weet welk model draait, met hoeveel context en welke tool-ondersteuning. Via GET /v1/models zie je live wat er geserveerd wordt. Verschijnt er een beter open codeermodel, dan verifiëren we het en komt het in de lijst.
Je prompts en code worden niet gebruikt om modellen te trainen. Wat je stuurt is van jou en blijft van jou.
Inference draait op GPU's in de EU. Je verkeer verlaat Europa niet, ook niet voor logging of analyse.
Een DPA is beschikbaar voor teams die dit contractueel moeten vastleggen. Mail info@hostyourai.com.
Je laadt credits op vanaf €5 met iDEAL of kaart en betaalt per token, per model geprijsd. Op is op: je agent kan nooit meer uitgeven dan jij hebt klaargezet. Een middagje met een coding-agent kost typisch centen tot een paar euro.
Actuele tokenprijzen staan op de prijzenpagina.
Nee. Claude Code is alleen de tool in je terminal; de Claude-modellen erachter vervang je door open-weight modellen zoals Qwen, gehost door ons in de EU. Je verkeer gaat niet meer naar Anthropic.
Nee. Alles wat de Anthropic- of OpenAI-API spreekt werkt door met een andere base-URL en key. Claude Code, Cline en opencode hebben genoeg aan drie omgevingsvariabelen.
Nu een Qwen3.6-codeermodel met tools en 32k context, het beste open-weight model dat we geverifieerd hebben. De lijst groeit als er betere open modellen verschijnen.
Een warme GPU antwoordt vlot en streamt token voor token. Is het model koud, dan start je eerste vraag een GPU op en duurt het een paar minuten. Daarna blijft hij warm zolang je werkt.
Per token vanaf je prepaid creditsaldo. Een middagje met een coding-agent kost typisch centen tot een paar euro; elk request zie je live in je verbruik.
Nee. Geen abonnement; je laadt op wanneer jij wilt en je tegoed blijft staan. En omdat de API's standaard zijn, wissel je net zo makkelijk weer terug.
Credits vanaf €5, geen abonnement. Je eerste sessie draait binnen een paar minuten.