GPU & infra

AI Infrastructuur Nederland

Complete AI infrastructuur stack gehost in Nederland. Van GPU tot API, wij hebben alles.

qwen3-8b vLLM ready
NVIDIA A100 · 40GB · EU marketplace · eu-central
VRAM19.2 / 40 GB
GPU utilisation71%
42 ms
time-to-first-token
128
tokens / sec
62°C
temperature
POST /api/v1/chat/completions200 OK

AI-infrastructuur is meer dan een GPU met een model erop. Wie serieus met taalmodellen bouwt, heeft ook een plek nodig om modellen te vergelijken, verbruik per request terug te zien, te experimenteren zonder code en te schakelen tussen gedeelde en dedicated capaciteit. HostYourAI brengt die hele stack samen op één Europees platform, van een Nederlands bedrijf uit Groningen.

Het uitgangspunt is simpel: open modellen zoals Llama, Qwen, Mistral en DeepSeek, geserveerd via vLLM in Europese datacenters, bereikbaar via een OpenAI-compatible API. Alles rekent af vanaf hetzelfde prepaid creditsaldo, of je nu per token betaalt of per GPU-uur.

Waarom AI-infrastructuur in de EU

Soevereiniteit als strategische keuze

Organisaties die hun AI-laag op Amerikaanse platforms bouwen, maken zich afhankelijk van prijsbeleid, productkeuzes en wetgeving waar ze geen invloed op hebben. Europese infrastructuur met open modellen draait die afhankelijkheid om: jij kiest, en je kunt altijd weg met dezelfde modelgewichten.

Gegevensbescherming over de hele keten

Een AVG-verhaal is zo sterk als de zwakste schakel. Als je API, je GPU's en je logging allemaal binnen de EU blijven, met een verwerkersovereenkomst en een openbare subprocessor-lijst, dan klopt het verhaal van prompt tot antwoord. Er wordt bovendien niet getraind op klantdata.

Snelle antwoorden binnen Europa

Infrastructuur die fysiek dicht bij je gebruikers staat, houdt streaming vlot en de gebruikerservaring strak. Voor Europese eindgebruikers is een Europees endpoint gewoon de kortste route.

python
from openai import OpenAI
client = OpenAI(
    base_url="https://hostyourai.com/api/v1",
    api_key="hyai-...")
client.chat.completions.create(
    model="llama-3.3-70b",
    messages=[{"role":"user","content":"Hallo!"}])

De bouwstenen van het platform

Het platform bestaat uit een handvol onderdelen die op elkaar aansluiten maar los te gebruiken zijn. De EU Inference Router is het gedeelde endpoint waarop je per token betaalt. Dedicated GPU-instances geven je een eigen vLLM-server per uur. De Model Garden op het modeloverzicht toont per model de status: warm, aan het opwarmen, serveerbaar of op aanvraag. En wie documenten wil laten meewegen, koppelt een kennisbank; de gids RAG bouwen op EU-GPUs legt uit hoe.

BouwsteenWat het doet
RouterGedeeld OpenAI-compatible endpoint, betalen per token
Dedicated instancesEigen vLLM-server per uur, eigen versleutelde API-key, idle-down
Model GardenCatalogus met 100+ open modellen en hun status (warm, aan het opwarmen, serveerbaar, op aanvraag)
PlaygroundModellen testen in de browser, zonder code
Activity en usageVerbruik en requests per stuk terugzien
CreditsaldoEén prepaid saldo voor al het gebruik, opwaarderen via iDEAL, creditcard of SEPA
One-click deployment
OpenAI-compatible API
4 EU datacenters
End-to-end encryptie
Dedicated GPU instances
Audit logging

Zo begin je

Elke bouwsteen spreekt dezelfde API. Eén client, en je kunt zowel de Router als je eigen instances aanroepen.

import OpenAI from "openai";

// base_url="https://hostyourai.com/api/v1"
const client = new OpenAI({
  baseURL: "https://hostyourai.com/api/v1",
  apiKey: "hyai-jouw-key",
});

const resp = await client.chat.completions.create({
  model: "gemma-3-27b",
  messages: [{ role: "user", content: "Noem drie risico's van schaduw-IT in een middelgrote organisatie, met per risico één zin mitigatie." }],
});
console.log(resp.choices[0].message.content);
je vraag
doc-4f2a0.94
doc-9c1e0.91
doc-2b770.88

Vragen over AI-infrastructuur

Moet ik het hele platform gebruiken of kan ik klein beginnen?

Je kunt klein beginnen. Veel teams starten met alleen de Router en een paar prompts in de Playground, en voegen pas een dedicated instance toe als het volume of de gevoeligheid van de data daarom vraagt.

Wat betekenen de statussen in de Model Garden?

Warm betekent direct beschikbaar via de warm pool, aan het opwarmen betekent dat capaciteit wordt gestart, serveerbaar betekent dat het model gedeployd kan worden, en op aanvraag betekent dat je het kunt aanvragen.

Hoe zie ik wat mijn applicatie verbruikt?

In de app zie je activity en usage per request terug, zodat je per toepassing weet wat er gebeurt en wat het van je saldo trekt.

Kan de infrastructuur ook mijn eigen documenten gebruiken?

Ja. Je koppelt een kennisbank aan de Router of aan een instance, waarna relevante context automatisch in chat completions wordt geïnjecteerd. Niet-streaming responses vermelden de gebruikte bronnen.

Hoe werkt de betaling over alle onderdelen heen?

Alles loopt via één prepaid creditsaldo: Router-gebruik per token, instances per uur. Wat dat kost per model staat op de prijzenpagina.

Je app
OpenAI · Anthropic
EU Router
één base URL
Qwen3-8B
warm
Loes (NL)
soeverein
Llama-3.3
warm

Alles wat je nodig hebt voor AI

Van model-hosting tot een klantgerichte API, gebouwd voor developers en bedrijven die hun AI op infrastructuur willen draaien die ze echt beheren, binnen de EU.

100%
EU-gehost

Je data en je modellen blijven op Europese GPUs. GDPR-vriendelijk vanaf de basis.

200+
Geverifieerde modellen, klaar om te serveren

Llama, Qwen, DeepSeek, Mistral, FLUX en nog veel meer. Kies er een en hij is binnen minuten warm, zonder DevOps aan jouw kant.

2 SDK
OpenAI- en Anthropic-compatibel

Richt je bestaande client op de Router en behoud je tools. Geen herschrijven, geen lock-in.

Van nul naar een warm endpoint in minuten

Geen infra om te beheren. Kies een model, krijg een OpenAI-compatibele URL, ship.

1

Kies een model

Kies uit de Model Garden of plak een willekeurig HuggingFace-ID. Stel de VRAM in en kies een EU-GPU.

2

Krijg je endpoint

Wij deployen vLLM, draaien readiness-probes en geven je een warme OpenAI- en Anthropic-compatibele URL plus een API-key.

3

Route en ship

Richt je client op de Router. Die routeert automatisch naar een warme instance, zet GPUs idle als niemand online is en logt elk verzoek.

Privé vanaf de basis

HostYourAI houdt je modellen, prompts en data op Europese GPUs. Gebouwd voor teams die geven om compliance, betrouwbaarheid en echte controle.

EU-gehostAVG-vriendelijkOpenAI-compatibelvLLMGeen lock-in
EU
Volledige datasoevereiniteit

GPU's en data binnen Europa. Je prompts verlaten de EU nooit.

Open
Modellen die je kunt auditen

Draai open-weight modellen zonder black boxes of verborgen telemetrie.

€0
Scale-to-zero

GPU's idlen als niemand online is, dus je betaalt alleen voor wat je draait.

Jouw
Geen vendor lock-in

Jouw infra, jouw keys, jouw modellen. Vertrek wanneer je wilt.

Werkt met de tools die je al gebruikt

De Router spreekt de OpenAI- en Anthropic-API, dus hij past direct in de clients en SDKs die je team al draait. Verander alleen de base-URL.

Probeer HostYourAI gratis
docker
anthropic
huggingface
langchain
python
nodedotjs
curl
ollama
jetbrains
jupyter
vercel
zapier
postman
n8n

Veelgestelde vragen

Kan ik dit in de EU draaien?

Ja. HostYourAI draait open modellen op GPU's in Europese datacenters via vLLM. Je prompts en outputs verlaten de EU niet en er zit geen Amerikaanse cloudprovider in de keten.

Is het AVG/GDPR-compliant?

Ja. Alle verwerking gebeurt binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open gewichten betekenen ook: geen training op jouw data.

Is de API compatibel met OpenAI?

Ja. Je richt je bestaande OpenAI- of Anthropic-client op onze Router (https://hostyourai.com/api/v1), alleen de base-URL en API-key wijzigen. Geen rewrite, geen lock-in.

Wat kost het?

Pay-as-you-go met één prepaid creditsaldo: de gedeelde router per token of een dedicated GPU per uur. Gratis te starten, geen minimum, geen vaste maandkosten.

Model garden

Werkt met 390+ open modellen

Tekst- en beeldmodellen op dedicated EU GPU's. Elk model getest op onze eigen hardware.

Ook interessant

Verken meer over EU-gehoste AI op HostYourAI.

Host. Route. Ship.

Geen creditcard nodig. Betaal naar gebruik, stop wanneer je wilt.

Begin vandaag gratis met hosten