GPU & infra

Dedicated GPU Hosting

Volledige GPU capaciteit voor jouw workloads. Geen sharing, geen "noisy neighbors", consistente performance.

qwen3-8b vLLM ready
NVIDIA A100 · 40GB · EU marketplace · eu-central
VRAM19.2 / 40 GB
GPU utilisation71%
42 ms
time-to-first-token
128
tokens / sec
62°C
temperature
POST /api/v1/chat/completions200 OK

Bij dedicated GPU hosting is de kaart van jou. Geen andere klanten op dezelfde GPU, geen wachtrij achter andermans batchjob: de volledige rekenkracht staat klaar voor jouw workload en alleen voor die van jou. Dat merk je vooral in de voorspelbaarheid: hetzelfde model geeft onder dezelfde belasting dezelfde responstijden, dag in dag uit.

HostYourAI levert dedicated GPU's in Europese datacenters, met vLLM voorgeconfigureerd en een OpenAI-compatible endpoint. Jij kiest het open model, van Llama tot DeepSeek of een eigen HuggingFace-ID, en je instance krijgt een eigen versleutelde API-key. Afrekenen gaat per uur, vanaf een prepaid creditsaldo.

Waarom dedicated GPU hosting in de EU

Voorspelbare prestaties zonder buren

Op gedeelde infrastructuur bepalen andere klanten mee hoe druk het is. Op een dedicated GPU bestaat dat "noisy neighbour"-effect niet: jouw latency wordt bepaald door jouw eigen verkeer. Voor productietoepassingen met gebruikers die zitten te wachten is dat het hele punt.

Gevoelige workloads, aantoonbaar afgeschermd

Een eigen GPU met een eigen vLLM-server is makkelijk uit te leggen aan een privacy-officer: deze hardware, dit model, deze data, niets gedeeld. Samen met een verwerkersovereenkomst, een openbare subprocessor-lijst en de garantie dat er niet op klantdata wordt getraind, staat je AVG-dossier snel.

Los van de grote Amerikaanse clouds

Dedicated capaciteit huren bij een hyperscaler blijft capaciteit onder Amerikaans recht. Bij een Nederlands bedrijf uit Groningen valt je inference onder Europese jurisdictie, en dat is voor steeds meer klanten en aanbestedingen een harde eis.

python
from openai import OpenAI
client = OpenAI(
    base_url="https://hostyourai.com/api/v1",
    api_key="hyai-...")
client.chat.completions.create(
    model="llama-3.3-70b",
    messages=[{"role":"user","content":"Hallo!"}])

Wanneer dedicated loont, en wanneer de Router volstaat

Dedicated is niet automatisch beter, het is beter voor een bepaald soort werk. Draai je constant volume, wil je een specifiek model dat niet in de catalogus staat, of moet je isolatie kunnen aantonen, dan wint een instance van dedicated GPU-instances. Is je verkeer grillig of ben je nog aan het verkennen, dan is de EU Inference Router logischer: daar betaal je per token en staat de capaciteit al warm. Omdat beide vanaf hetzelfde creditsaldo werken, kun je zonder overstapkosten combineren.

SituatieBeste keuze
Grillig of laag volume, af en toe een piekRouter, betalen per token
Constant hoog volume, hele dag door verkeerDedicated instance per uur
Specifiek model buiten de catalogus (eigen HuggingFace-ID)Dedicated instance
Prototype of demo, snel iets proberenRouter, eventueel eerst in de Playground
Aantoonbare isolatie vereist voor complianceDedicated instance
Meerdere modellen naast elkaar vergelijkenRouter, via de catalogus
qwen3-8b vLLM ready
NVIDIA A100 · 40GB · EU marketplace · eu-central
VRAM19.2 / 40 GB
GPU utilisation71%
42 ms
time-to-first-token
128
tokens / sec
62°C
temperature
POST /api/v1/chat/completions200 OK

Zo begin je

Een dedicated endpoint gedraagt zich als elke OpenAI-compatible API, dus je eerste test is een paar regels code.

from openai import OpenAI

client = OpenAI(
    base_url="https://hostyourai.com/api/v1",
    api_key="hyai-jouw-key"
)

resp = client.chat.completions.create(
    model="llama-3.1-8b",
    messages=[{"role": "user", "content": "Classificeer deze klantmail als vraag, klacht of compliment: 'De levering kwam een dag te laat, maar de verpakking was netjes.'"}]
)
print(resp.choices[0].message.content)
One-click deployment
OpenAI-compatible API
4 EU datacenters
End-to-end encryptie
Dedicated GPU instances
Audit logging

Vragen over dedicated GPU hosting

Wat is een noisy neighbour en heb ik daar hier last van?

Een noisy neighbour is een andere klant op dezelfde hardware die jouw prestaties drukt. Op een dedicated GPU bestaat dat niet: de kaart draait uitsluitend jouw workload.

Krijg ik een eigen API-key voor mijn instance?

Ja. Elke instance draait vLLM met een eigen API-key die versleuteld wordt opgeslagen. Alleen wie die key heeft, kan je model aanroepen.

Welke modellen kan ik op een dedicated GPU draaien?

Elk open model dat vLLM ondersteunt. Kies uit de ruim honderd modellen in het modeloverzicht of geef een eigen HuggingFace-ID op; een VRAM-ondergrens bij deploy voorkomt een te kleine GPU.

Betaal ik door als er geen verkeer is?

Instances schalen naar idle bij geen gebruik. Zo combineert dedicated hosting voorspelbare prestaties met kosten die meebewegen met je werkelijke gebruik.

Kan ik dedicated hosting combineren met de Router?

Ja, veel teams doen precies dat: de Router voor experimenten en licht verkeer, een dedicated instance voor de productieworkload. Beide betalen vanaf hetzelfde prepaid saldo; zie de prijzenpagina.

je vraag
doc-4f2a0.94
doc-9c1e0.91
doc-2b770.88

Alles wat je nodig hebt voor AI

Van model-hosting tot een klantgerichte API, gebouwd voor developers en bedrijven die hun AI op infrastructuur willen draaien die ze echt beheren, binnen de EU.

100%
EU-gehost

Je data en je modellen blijven op Europese GPUs. GDPR-vriendelijk vanaf de basis.

200+
Geverifieerde modellen, klaar om te serveren

Llama, Qwen, DeepSeek, Mistral, FLUX en nog veel meer. Kies er een en hij is binnen minuten warm, zonder DevOps aan jouw kant.

2 SDK
OpenAI- en Anthropic-compatibel

Richt je bestaande client op de Router en behoud je tools. Geen herschrijven, geen lock-in.

Van nul naar een warm endpoint in minuten

Geen infra om te beheren. Kies een model, krijg een OpenAI-compatibele URL, ship.

1

Kies een model

Kies uit de Model Garden of plak een willekeurig HuggingFace-ID. Stel de VRAM in en kies een EU-GPU.

2

Krijg je endpoint

Wij deployen vLLM, draaien readiness-probes en geven je een warme OpenAI- en Anthropic-compatibele URL plus een API-key.

3

Route en ship

Richt je client op de Router. Die routeert automatisch naar een warme instance, zet GPUs idle als niemand online is en logt elk verzoek.

Werkt met de tools die je al gebruikt

De Router spreekt de OpenAI- en Anthropic-API, dus hij past direct in de clients en SDKs die je team al draait. Verander alleen de base-URL.

Probeer HostYourAI gratis
docker
anthropic
huggingface
langchain
python
nodedotjs
curl
ollama
jetbrains
jupyter
vercel
zapier
postman
n8n

Gebouwd voor teams die data niet mogen wegsturen

Als een Amerikaanse cloud geen optie is, geeft HostYourAI je dezelfde developer-ervaring op Europese infrastructuur.

Overheid & publieke sector

Burgerdata die wettelijk in de EU moet blijven, volledig auditeerbaar.

Gereguleerde enterprise

Finance-, zorg- en juridische teams onder GDPR, DORA en de AI Act.

EU SaaS & scale-ups

Lever AI-functies waar je klanten op vertrouwen, zonder Amerikaanse sub-processor.

Agencies & integrators

Lever privé-AI voor klanten op infrastructuur waar je achter kunt staan.

Veelgestelde vragen

Kan ik dit in de EU draaien?

Ja. HostYourAI draait open modellen op GPU's in Europese datacenters via vLLM. Je prompts en outputs verlaten de EU niet en er zit geen Amerikaanse cloudprovider in de keten.

Is het AVG/GDPR-compliant?

Ja. Alle verwerking gebeurt binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open gewichten betekenen ook: geen training op jouw data.

Is de API compatibel met OpenAI?

Ja. Je richt je bestaande OpenAI- of Anthropic-client op onze Router (https://hostyourai.com/api/v1), alleen de base-URL en API-key wijzigen. Geen rewrite, geen lock-in.

Wat kost het?

Pay-as-you-go met één prepaid creditsaldo: de gedeelde router per token of een dedicated GPU per uur. Gratis te starten, geen minimum, geen vaste maandkosten.

Model garden

Werkt met 390+ open modellen

Tekst- en beeldmodellen op dedicated EU GPU's. Elk model getest op onze eigen hardware.

Ook interessant

Verken meer over EU-gehoste AI op HostYourAI.

Host. Route. Ship.

Geen creditcard nodig. Betaal naar gebruik, stop wanneer je wilt.

Begin vandaag gratis met hosten