Compliance & soevereiniteit

On-Premise AI Alternatief

De voordelen van on-premise (controle, privacy) zonder de nadelen (kosten, complexiteit).

EU Data Sovereignty
Doornbos Ventures B.V. · NL
Compliant
EU datacenters
Verspreid over meerdere Europese regio's
GDPR compliant
Verwerkersovereenkomst (DPA) als sub-processor
Geen CLOUD Act
Nederlands bedrijf, buiten Amerikaanse jurisdictie
Versleuteld
AES-256 at rest, TLS in transit
Geen training
Je prompts trainen nooit een model

De wens voor on-premise AI komt zelden voort uit liefde voor serverbeheer. Het gaat om controle: weten waar je data staat, geen afhankelijkheid van Amerikaanse clouds, zelf de sleutels in handen. Maar eigen GPU-servers kopen betekent kapitaal vastleggen, schaarse hardware bemachtigen en mensen vrijmaken voor beheer, terwijl het modellandschap elk kwartaal verschuift.

Er is een middenweg: dezelfde controle-argumenten, geleverd vanuit Europese datacenters. Bij HostYourAI draai je open modellen op een dedicated GPU-instance die alleen van jou is, zonder ooit een server te kopen.

Waarom een on-premise alternatief in de EU

De controle-argumenten blijven overeind

Wat on-premise aantrekkelijk maakt, behoud je grotendeels: verwerking binnen de EU, open modelgewichten die je kunt inspecteren, een eigen versleutelde API-key op je instance en de garantie dat er niet op je data wordt getraind. Het verschil zit vooral in wie de hardware onderhoudt.

Zonder de hardware-rekening

GPU's zijn kostbaar, snel verouderd en lastig leverbaar. Huur je ze per uur, dan wissel je net zo makkelijk van GPU-klasse wanneer modellen groter of juist efficiënter worden. Je betaalt vanaf een prepaid creditsaldo, opwaarderen kan met iDEAL, creditcard of SEPA; hoe dat werkt staat op de prijzenpagina.

Soevereiniteitseisen in inkoop en aanbesteding

Steeds meer organisaties, van overheden tot gereguleerde bedrijven, stellen eisen aan datalocatie en jurisdictie. Een Europese keten met DPA en openbare subprocessor-lijst beantwoordt die eisen, zonder dat je zelf een serverruimte hoeft te verantwoorden.

EU Inference Router

‹ Insight 1 of 28 ›
98.7% ↗ 12%
4,931 of 5,000 requests served warm
EU-hostedModels run on European GPUs
Drop-inOpenAI and Anthropic compatible
Scale to zeroGPUs idle when nobody is online

On-premise versus dedicated EU-instance: wat je opgeeft en wat je wint

Eerlijk is eerlijk: on-premise geeft je fysieke controle die geen externe partij kan evenaren. Wat je daarvoor inlevert is snelheid en flexibiliteit. Met een dedicated instance kies je een model uit het modeloverzicht of plak je een HuggingFace-ID, en vLLM staat er voorgeconfigureerd op, beveiligd met AES-256 encryptie at rest en TLS in transit, met een 99.9% uptime SLA. Blijkt het model te zwaar of te licht, dan deploy je opnieuw op een andere GPU-klasse in plaats van hardware bij te bestellen. En omdat de gewichten open zijn en de API OpenAI-compatible, blijft de weg terug naar eigen hardware later altijd open.

AfwegingOn-premiseHostYourAI dedicated
AanschafGPU-servers kopen en afschrijvenHuren per uur, stoppen wanneer je wilt
BeheerEigen mensen voor drivers, serving en onderhoudvLLM voorgeconfigureerd, platform onderhoudt de stack
DatalocatieEigen pandEuropese datacenters, vastgelegd in de DPA
ToegangEigen netwerk en fysieke controleEigen versleutelde API-key per instance
OpschalenHardware bestellen en wachten op leveringAndere GPU-klasse kiezen bij een nieuwe deploy
Model past niet op de hardwareZelf uitrekenen en uitproberenVRAM-ondergrens bewaakt de match automatisch
qwen3-8b vLLM ready
NVIDIA A100 · 40GB · EU marketplace · eu-central
VRAM19.2 / 40 GB
GPU utilisation71%
42 ms
time-to-first-token
128
tokens / sec
62°C
temperature
POST /api/v1/chat/completions200 OK

Zo begin je

Een dedicated instance gedraagt zich als elk OpenAI-compatible endpoint. Je test hem zo vanuit Python.

from openai import OpenAI

client = OpenAI(
    base_url="https://hostyourai.com/api/v1",
    api_key="hyai-jouw-key"
)

antwoord = client.chat.completions.create(
    model="qwen3-32b",
    messages=[{"role": "user", "content": "Leg in twee zinnen uit wat datalokaliteit betekent."}]
)
print(antwoord.choices[0].message.content)
One-click deployment
OpenAI-compatible API
4 EU datacenters
End-to-end encryptie
Dedicated GPU instances
Audit logging

Vragen over een on-premise alternatief

Is dit net zo veilig als on-premise?

Het is anders. On-premise geeft fysieke controle, hier krijg je AES-256 encryptie at rest, TLS in transit, een eigen versleutelde API-key en een contractuele EU-keten. Voor de meeste organisaties dekt dat de risico's waar het om begon.

Deel ik een GPU met andere klanten?

Niet op een dedicated instance: die GPU draait alleen jouw model. De gedeelde Router is er voor wie liever per token betaalt en geen eigen GPU nodig heeft.

Kan ik later alsnog naar eigen hardware?

Ja. De modelgewichten zijn open en je code praat tegen een OpenAI-compatible API. Dezelfde stack kun je later on-premise opzetten zonder je applicatie te herbouwen.

Wie kan er bij mijn model en mijn data?

Je instance is afgeschermd met een eigen versleutelde API-key, er wordt niet op je data getraind, en welke partijen in de keten zitten staat in de openbare subprocessor-lijst.

Mijn organisatie sluit Amerikaanse clouds uit. Past dit dan?

De serving draait in Europese datacenters bij een Nederlands bedrijf. Toets de openbare subprocessor-lijst aan je eigen inkoopbeleid; die is er precies voor dat doel.

Hoe snel sta ik live vergeleken met eigen hardware?

Een deploy is een kwestie van model en GPU kiezen, geen inkooptraject. Waar eigen hardware weken tot maanden doorlooptijd kent, werk je hier dezelfde dag nog tegen je endpoint.

je vraag
doc-4f2a0.94
doc-9c1e0.91
doc-2b770.88

Alles wat je nodig hebt voor AI

Van model-hosting tot een klantgerichte API, gebouwd voor developers en bedrijven die hun AI op infrastructuur willen draaien die ze echt beheren, binnen de EU.

100%
EU-gehost

Je data en je modellen blijven op Europese GPUs. GDPR-vriendelijk vanaf de basis.

200+
Geverifieerde modellen, klaar om te serveren

Llama, Qwen, DeepSeek, Mistral, FLUX en nog veel meer. Kies er een en hij is binnen minuten warm, zonder DevOps aan jouw kant.

2 SDK
OpenAI- en Anthropic-compatibel

Richt je bestaande client op de Router en behoud je tools. Geen herschrijven, geen lock-in.

Van nul naar een warm endpoint in minuten

Geen infra om te beheren. Kies een model, krijg een OpenAI-compatibele URL, ship.

1

Kies een model

Kies uit de Model Garden of plak een willekeurig HuggingFace-ID. Stel de VRAM in en kies een EU-GPU.

2

Krijg je endpoint

Wij deployen vLLM, draaien readiness-probes en geven je een warme OpenAI- en Anthropic-compatibele URL plus een API-key.

3

Route en ship

Richt je client op de Router. Die routeert automatisch naar een warme instance, zet GPUs idle als niemand online is en logt elk verzoek.

Gebouwd voor teams die data niet mogen wegsturen

Als een Amerikaanse cloud geen optie is, geeft HostYourAI je dezelfde developer-ervaring op Europese infrastructuur.

Overheid & publieke sector

Burgerdata die wettelijk in de EU moet blijven, volledig auditeerbaar.

Gereguleerde enterprise

Finance-, zorg- en juridische teams onder GDPR, DORA en de AI Act.

EU SaaS & scale-ups

Lever AI-functies waar je klanten op vertrouwen, zonder Amerikaanse sub-processor.

Agencies & integrators

Lever privé-AI voor klanten op infrastructuur waar je achter kunt staan.

Privé vanaf de basis

HostYourAI houdt je modellen, prompts en data op Europese GPUs. Gebouwd voor teams die geven om compliance, betrouwbaarheid en echte controle.

EU-gehostAVG-vriendelijkOpenAI-compatibelvLLMGeen lock-in
EU
Volledige datasoevereiniteit

GPU's en data binnen Europa. Je prompts verlaten de EU nooit.

Open
Modellen die je kunt auditen

Draai open-weight modellen zonder black boxes of verborgen telemetrie.

€0
Scale-to-zero

GPU's idlen als niemand online is, dus je betaalt alleen voor wat je draait.

Jouw
Geen vendor lock-in

Jouw infra, jouw keys, jouw modellen. Vertrek wanneer je wilt.

Veelgestelde vragen

Kan ik dit in de EU draaien?

Ja. HostYourAI draait open modellen op GPU's in Europese datacenters via vLLM. Je prompts en outputs verlaten de EU niet en er zit geen Amerikaanse cloudprovider in de keten.

Is het AVG/GDPR-compliant?

Ja. Alle verwerking gebeurt binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open gewichten betekenen ook: geen training op jouw data.

Is de API compatibel met OpenAI?

Ja. Je richt je bestaande OpenAI- of Anthropic-client op onze Router (https://hostyourai.com/api/v1), alleen de base-URL en API-key wijzigen. Geen rewrite, geen lock-in.

Wat kost het?

Pay-as-you-go met één prepaid creditsaldo: de gedeelde router per token of een dedicated GPU per uur. Gratis te starten, geen minimum, geen vaste maandkosten.

Model garden

Werkt met 390+ open modellen

Tekst- en beeldmodellen op dedicated EU GPU's. Elk model getest op onze eigen hardware.

Ook interessant

Verken meer over EU-gehoste AI op HostYourAI.

Host. Route. Ship.

Geen creditcard nodig. Betaal naar gebruik, stop wanneer je wilt.

Begin vandaag gratis met hosten