Model hosting

Mistral Hosting Nederland

Deploy Mistral AI modellen op Nederlandse infrastructuur. Het Europese AI model op Europese servers.

qwen3-8b vLLM ready
NVIDIA A100 · 40GB · EU marketplace · eu-central
VRAM19.2 / 40 GB
GPU utilisation71%
42 ms
time-to-first-token
128
tokens / sec
62°C
temperature
POST /api/v1/chat/completions200 OK

Mistral is het bekendste Europese antwoord op de grote Amerikaanse en Chinese modelbouwers, en een flink deel van de familie is open-weight: Mistral 7B, Mistral Nemo, Mixtral en Mistral Small kun je zelf draaien. Combineer je die modellen met Europese GPU's, dan heb je iets dat zeldzaam is in AI: een stack die van modelgewichten tot datacenter Europees is.

Bij HostYourAI draai je open-weight Mistral-modellen via vLLM, vanuit Nederland beheerd, in Europese datacenters. Je spreekt ze aan via een OpenAI-compatible API, dus je bestaande code hoeft er niet voor om.

Waarom Mistral-modellen hosten in de EU

Een Europese stack van gewichten tot GPU

Een Europees model via een Amerikaanse cloud aanroepen lost maar de helft van het verhaal op. Host je de open gewichten op Europese infrastructuur, bij een Nederlands bedrijf met een DPA en een openbare subprocessor-lijst, dan is de hele keten Europees en kun je dat ook aantonen.

Sterk in meertalig werk, ook in het Nederlands

Mistral-modellen zijn vanaf het begin met Europese talen getraind en houden zich in de praktijk goed staande in Nederlandse chat-, samenvattings- en schrijftaken. Test dat vooral zelf: in de Playground chat je zonder code met elk model uit de catalogus.

Overstappen zonder herbouwen

Gebruik je nu een gesloten API, dan is een open-weight Mistral-model een van de soepelste migratiepaden: het endpoint is OpenAI-compatible, dus je wisselt vooral base-URL en key. De gids OpenAI migreren naar de EU Router loopt de stappen langs.

python
from openai import OpenAI
client = OpenAI(
    base_url="https://hostyourai.com/api/v1",
    api_key="hyai-...")
client.chat.completions.create(
    model="llama-3.3-70b",
    messages=[{"role":"user","content":"Hallo!"}])

Welk Mistral-model voor welke taak

De familie dekt een breed spectrum. Mistral 7B is klein, snel en goedkoop te draaien: prima voor classificatie, extractie en eenvoudige chat. Mistral Nemo (12B) is de meertalige allrounder met een ruime context. Mixtral 8x7B gebruikt een mixture-of-experts-opzet: het activeert per token maar een deel van zijn gewichten en biedt daardoor veel kwaliteit per rekenstap. Mistral Small is de sterkste open-weight generalist van de familie voor redeneer- en schrijfwerk. Welke varianten precies beschikbaar zijn wisselt; check het modeloverzicht voor de actuele catalogus. Voor structureel gebruik van één model is een dedicated GPU-instance per uur vaak logischer dan per token via de EU Inference Router.

ModelSterk in
Mistral 7BClassificatie, extractie en simpele chat tegen lage kosten
Mistral Nemo (12B)Meertalige chat en samenvatten, ruime context
Mixtral 8x7BVeelzijdige taken met veel kwaliteit per rekenstap dankzij mixture-of-experts
Mistral SmallRedeneren, schrijven en instructies volgen als open-weight generalist
DevstralCodetaken en agent-achtige programmeerworkflows
qwen3-8b vLLM ready
NVIDIA A100 · 40GB · EU marketplace · eu-central
VRAM19.2 / 40 GB
GPU utilisation71%
42 ms
time-to-first-token
128
tokens / sec
62°C
temperature
POST /api/v1/chat/completions200 OK

Zo begin je

Kies een Mistral-model uit de catalogus, maak een API-key aan en wijs de OpenAI SDK naar het platform.

from openai import OpenAI

client = OpenAI(
    base_url="https://hostyourai.com/api/v1",
    api_key="hyai-jouw-key"
)

antwoord = client.chat.completions.create(
    model="mistral-7b",
    messages=[{"role": "user", "content": "Schrijf een nette Nederlandse afwijzingsmail voor een sollicitant, twee alinea's."}]
)
print(antwoord.choices[0].message.content)
One-click deployment
OpenAI-compatible API
4 EU datacenters
End-to-end encryptie
Dedicated GPU instances
Audit logging

Vragen over Mistral-modellen hosten

Kan ik ook Mistral Large draaien?

Nee. Mistral Large is geen vrij open-weight model dat je zomaar zelf mag hosten; het platform richt zich op de open-weight familie zoals Mistral 7B, Nemo, Mixtral en Mistral Small. Het modeloverzicht toont wat er actueel beschikbaar is.

Mag ik Mistral-modellen commercieel gebruiken?

Veel open-weight Mistral-modellen verschijnen onder de Apache 2.0-licentie en zijn commercieel vrij te gebruiken. Controleer wel altijd de licentie van de specifieke versie die je kiest; die staat bij het model vermeld.

Kies ik de Router of een dedicated instance?

Begin op de gedeelde Router en betaal per token. Draai je één Mistral-model structureel met serieus volume, dan wordt een dedicated instance per uur interessant, met een eigen versleutelde API-key.

Werkt mijn bestaande OpenAI-code met Mistral-modellen?

Ja. Het endpoint is OpenAI-compatible, dus je verandert alleen de base-URL, de key en de modelnaam. Streaming via SSE werkt zoals je gewend bent.

Hoe goed is Nederlands vergeleken met grotere modellen?

Mistral-modellen doen Nederlands behoorlijk, maar de beste keuze hangt af van je taak. Vergelijk in de Playground een Mistral-model met bijvoorbeeld een Llama- of Qwen-variant op je eigen prompts voordat je vastlegt.

Kan ik een gefinetunede Mistral-variant hosten?

Ja. Zet de gewichten in een HuggingFace-repository en deploy die op een dedicated instance via het model-ID. De VRAM-ondergrens zorgt dat de GPU bij het model past.

je vraag
doc-4f2a0.94
doc-9c1e0.91
doc-2b770.88

Alles wat je nodig hebt voor AI

Van model-hosting tot een klantgerichte API, gebouwd voor developers en bedrijven die hun AI op infrastructuur willen draaien die ze echt beheren, binnen de EU.

100%
EU-gehost

Je data en je modellen blijven op Europese GPUs. GDPR-vriendelijk vanaf de basis.

200+
Geverifieerde modellen, klaar om te serveren

Llama, Qwen, DeepSeek, Mistral, FLUX en nog veel meer. Kies er een en hij is binnen minuten warm, zonder DevOps aan jouw kant.

2 SDK
OpenAI- en Anthropic-compatibel

Richt je bestaande client op de Router en behoud je tools. Geen herschrijven, geen lock-in.

Van nul naar een warm endpoint in minuten

Geen infra om te beheren. Kies een model, krijg een OpenAI-compatibele URL, ship.

1

Kies een model

Kies uit de Model Garden of plak een willekeurig HuggingFace-ID. Stel de VRAM in en kies een EU-GPU.

2

Krijg je endpoint

Wij deployen vLLM, draaien readiness-probes en geven je een warme OpenAI- en Anthropic-compatibele URL plus een API-key.

3

Route en ship

Richt je client op de Router. Die routeert automatisch naar een warme instance, zet GPUs idle als niemand online is en logt elk verzoek.

Werkt met de tools die je al gebruikt

De Router spreekt de OpenAI- en Anthropic-API, dus hij past direct in de clients en SDKs die je team al draait. Verander alleen de base-URL.

Probeer HostYourAI gratis
docker
anthropic
huggingface
langchain
python
nodedotjs
curl
ollama
jetbrains
jupyter
vercel
zapier
postman
n8n

Gebouwd voor teams die data niet mogen wegsturen

Als een Amerikaanse cloud geen optie is, geeft HostYourAI je dezelfde developer-ervaring op Europese infrastructuur.

Overheid & publieke sector

Burgerdata die wettelijk in de EU moet blijven, volledig auditeerbaar.

Gereguleerde enterprise

Finance-, zorg- en juridische teams onder GDPR, DORA en de AI Act.

EU SaaS & scale-ups

Lever AI-functies waar je klanten op vertrouwen, zonder Amerikaanse sub-processor.

Agencies & integrators

Lever privé-AI voor klanten op infrastructuur waar je achter kunt staan.

Veelgestelde vragen

Kan ik dit in de EU draaien?

Ja. HostYourAI draait open modellen op GPU's in Europese datacenters via vLLM. Je prompts en outputs verlaten de EU niet en er zit geen Amerikaanse cloudprovider in de keten.

Is het AVG/GDPR-compliant?

Ja. Alle verwerking gebeurt binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open gewichten betekenen ook: geen training op jouw data.

Is de API compatibel met OpenAI?

Ja. Je richt je bestaande OpenAI- of Anthropic-client op onze Router (https://hostyourai.com/api/v1), alleen de base-URL en API-key wijzigen. Geen rewrite, geen lock-in.

Wat kost het?

Pay-as-you-go met één prepaid creditsaldo: de gedeelde router per token of een dedicated GPU per uur. Gratis te starten, geen minimum, geen vaste maandkosten.

Model garden

Werkt met 390+ open modellen

Tekst- en beeldmodellen op dedicated EU GPU's. Elk model getest op onze eigen hardware.

Ook interessant

Verken meer over EU-gehoste AI op HostYourAI.

Host. Route. Ship.

Geen creditcard nodig. Betaal naar gebruik, stop wanneer je wilt.

Begin vandaag gratis met hosten