Deploy Mistral AI modellen op Nederlandse infrastructuur. Het Europese AI model op Europese servers.
Mistral is het bekendste Europese antwoord op de grote Amerikaanse en Chinese modelbouwers, en een flink deel van de familie is open-weight: Mistral 7B, Mistral Nemo, Mixtral en Mistral Small kun je zelf draaien. Combineer je die modellen met Europese GPU's, dan heb je iets dat zeldzaam is in AI: een stack die van modelgewichten tot datacenter Europees is.
Bij HostYourAI draai je open-weight Mistral-modellen via vLLM, vanuit Nederland beheerd, in Europese datacenters. Je spreekt ze aan via een OpenAI-compatible API, dus je bestaande code hoeft er niet voor om.
Een Europees model via een Amerikaanse cloud aanroepen lost maar de helft van het verhaal op. Host je de open gewichten op Europese infrastructuur, bij een Nederlands bedrijf met een DPA en een openbare subprocessor-lijst, dan is de hele keten Europees en kun je dat ook aantonen.
Mistral-modellen zijn vanaf het begin met Europese talen getraind en houden zich in de praktijk goed staande in Nederlandse chat-, samenvattings- en schrijftaken. Test dat vooral zelf: in de Playground chat je zonder code met elk model uit de catalogus.
Gebruik je nu een gesloten API, dan is een open-weight Mistral-model een van de soepelste migratiepaden: het endpoint is OpenAI-compatible, dus je wisselt vooral base-URL en key. De gids OpenAI migreren naar de EU Router loopt de stappen langs.
from openai import OpenAI client = OpenAI( base_url="https://hostyourai.com/api/v1", api_key="hyai-...") client.chat.completions.create( model="llama-3.3-70b", messages=[{"role":"user","content":"Hallo!"}])
De familie dekt een breed spectrum. Mistral 7B is klein, snel en goedkoop te draaien: prima voor classificatie, extractie en eenvoudige chat. Mistral Nemo (12B) is de meertalige allrounder met een ruime context. Mixtral 8x7B gebruikt een mixture-of-experts-opzet: het activeert per token maar een deel van zijn gewichten en biedt daardoor veel kwaliteit per rekenstap. Mistral Small is de sterkste open-weight generalist van de familie voor redeneer- en schrijfwerk. Welke varianten precies beschikbaar zijn wisselt; check het modeloverzicht voor de actuele catalogus. Voor structureel gebruik van één model is een dedicated GPU-instance per uur vaak logischer dan per token via de EU Inference Router.
| Model | Sterk in |
|---|---|
| Mistral 7B | Classificatie, extractie en simpele chat tegen lage kosten |
| Mistral Nemo (12B) | Meertalige chat en samenvatten, ruime context |
| Mixtral 8x7B | Veelzijdige taken met veel kwaliteit per rekenstap dankzij mixture-of-experts |
| Mistral Small | Redeneren, schrijven en instructies volgen als open-weight generalist |
| Devstral | Codetaken en agent-achtige programmeerworkflows |
Kies een Mistral-model uit de catalogus, maak een API-key aan en wijs de OpenAI SDK naar het platform.
from openai import OpenAI
client = OpenAI(
base_url="https://hostyourai.com/api/v1",
api_key="hyai-jouw-key"
)
antwoord = client.chat.completions.create(
model="mistral-7b",
messages=[{"role": "user", "content": "Schrijf een nette Nederlandse afwijzingsmail voor een sollicitant, twee alinea's."}]
)
print(antwoord.choices[0].message.content)Nee. Mistral Large is geen vrij open-weight model dat je zomaar zelf mag hosten; het platform richt zich op de open-weight familie zoals Mistral 7B, Nemo, Mixtral en Mistral Small. Het modeloverzicht toont wat er actueel beschikbaar is.
Veel open-weight Mistral-modellen verschijnen onder de Apache 2.0-licentie en zijn commercieel vrij te gebruiken. Controleer wel altijd de licentie van de specifieke versie die je kiest; die staat bij het model vermeld.
Begin op de gedeelde Router en betaal per token. Draai je één Mistral-model structureel met serieus volume, dan wordt een dedicated instance per uur interessant, met een eigen versleutelde API-key.
Ja. Het endpoint is OpenAI-compatible, dus je verandert alleen de base-URL, de key en de modelnaam. Streaming via SSE werkt zoals je gewend bent.
Mistral-modellen doen Nederlands behoorlijk, maar de beste keuze hangt af van je taak. Vergelijk in de Playground een Mistral-model met bijvoorbeeld een Llama- of Qwen-variant op je eigen prompts voordat je vastlegt.
Ja. Zet de gewichten in een HuggingFace-repository en deploy die op een dedicated instance via het model-ID. De VRAM-ondergrens zorgt dat de GPU bij het model past.
Van model-hosting tot een klantgerichte API, gebouwd voor developers en bedrijven die hun AI op infrastructuur willen draaien die ze echt beheren, binnen de EU.
Je data en je modellen blijven op Europese GPUs. GDPR-vriendelijk vanaf de basis.
Llama, Qwen, DeepSeek, Mistral, FLUX en nog veel meer. Kies er een en hij is binnen minuten warm, zonder DevOps aan jouw kant.
Richt je bestaande client op de Router en behoud je tools. Geen herschrijven, geen lock-in.
Geen infra om te beheren. Kies een model, krijg een OpenAI-compatibele URL, ship.
Kies uit de Model Garden of plak een willekeurig HuggingFace-ID. Stel de VRAM in en kies een EU-GPU.
Wij deployen vLLM, draaien readiness-probes en geven je een warme OpenAI- en Anthropic-compatibele URL plus een API-key.
Richt je client op de Router. Die routeert automatisch naar een warme instance, zet GPUs idle als niemand online is en logt elk verzoek.
De Router spreekt de OpenAI- en Anthropic-API, dus hij past direct in de clients en SDKs die je team al draait. Verander alleen de base-URL.
Probeer HostYourAI gratisAls een Amerikaanse cloud geen optie is, geeft HostYourAI je dezelfde developer-ervaring op Europese infrastructuur.
Burgerdata die wettelijk in de EU moet blijven, volledig auditeerbaar.
Finance-, zorg- en juridische teams onder GDPR, DORA en de AI Act.
Lever AI-functies waar je klanten op vertrouwen, zonder Amerikaanse sub-processor.
Lever privé-AI voor klanten op infrastructuur waar je achter kunt staan.
Ja. HostYourAI draait open modellen op GPU's in Europese datacenters via vLLM. Je prompts en outputs verlaten de EU niet en er zit geen Amerikaanse cloudprovider in de keten.
Ja. Alle verwerking gebeurt binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open gewichten betekenen ook: geen training op jouw data.
Ja. Je richt je bestaande OpenAI- of Anthropic-client op onze Router (https://hostyourai.com/api/v1), alleen de base-URL en API-key wijzigen. Geen rewrite, geen lock-in.
Pay-as-you-go met één prepaid creditsaldo: de gedeelde router per token of een dedicated GPU per uur. Gratis te starten, geen minimum, geen vaste maandkosten.
Tekst- en beeldmodellen op dedicated EU GPU's. Elk model getest op onze eigen hardware.
Verken meer over EU-gehoste AI op HostYourAI.
vLLM hosting op Europese infrastructure. PagedAttention, continuous batching, maximale throughput.
Lees meer →AI voor financiële instellingen op Europese GPUs. Data blijft in de EU, met open modellen, DPA en aandacht voor DORA en AVG.
Lees meer →Host Gemma 2 27B op dedicated NVIDIA A100 40GB in Nederlandse datacenters. GDPR compliant, pay-as-you-go, OpenAI-compatible API.
Lees meer →Private LLM hosting op dedicated hardware. Volledige isolatie, geen shared resources, eigen versleutelde API-key.
Lees meer →Een ChatGPT alternatief dat op open modellen en Europese GPUs draait. OpenAI-compatibele API, AVG-vriendelijk en zonder dat je data de EU verlaat.
Lees meer →Op zoek naar een AVG-conforme LLM API? HostYourAI draait open modellen in de EU met DPA, publieke subverwerkerslijst, zero retention en AES-256-encryptie.
Lees meer →Geen creditcard nodig. Betaal naar gebruik, stop wanneer je wilt.
Begin vandaag gratis met hosten