Model garden Router · auf Anfrage Dedicated · verfügbar

Mistral Nemo 12B

Läuft als eigenes dediziertes GPU-Deployment, direkt über den Wizard startbar. Daten bleiben in Europa.

Mistral Nemo 12B ist ein quelloffenes Sprachmodell von Mistral mit 12B Parametern und einem Kontextfenster von 131K Tokens, gehostet auf europäischen GPUs über eine OpenAI-kompatible API.

mistral-nemo-12b vLLM ready
text->text · mistralai · sovereign EU
Runs on EU infrastructure operated by European companies; US marketplace capacity is never part of this chain. Full chain
12B
Parameter
131K
Kontextfenster
32GB
Minimaler VRAM
POST /api/v1/chat/completions Auf Anfrage

Spezifikationen

Parameter 12B
Kontextfenster 131,072 tokens
Minimaler VRAM 32 GB
Architektur MistralForCausalLM (vLLM)
Lizenz open-weights
Modalität text->text
Anbieter mistralai ↗

Preise

Gemeinsamer Router · pro Token
Auf Anfrage
Nicht über den gemeinsamen Router verfügbar. Preis auf Anfrage als dediziertes GPU-Deployment.
Dediziertes GPU · pro Stunde
ab €1,68 pro Stunde
Eigene vLLM-Instanz in europäischer Cloud (32 GB VRAM), stundenweise abgerechnet.

Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.

✓ Funktionsfähig verifiziert am 25-07-2026, Antwort in 160 ms auf unserer EU-Infrastruktur.

Direkt aufrufen

Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mistral-nemo-12b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Häufig gestellte Fragen

Kann ich Mistral Nemo 12B in der EU betreiben?

Ja. HostYourAI betreibt Mistral Nemo 12B auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.

Ist das Hosting von Mistral Nemo 12B DSGVO-konform?

Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.

Was kostet Mistral Nemo 12B?

Mistral Nemo 12B ist auf Anfrage verfügbar: über den gemeinsamen EU-Router nach kurzer Abstimmung oder als dediziertes GPU-Deployment, das pro Stunde abgerechnet wird. Nennen Sie uns Ihren Anwendungsfall, dann richten wir es für Sie ein.

Ist die API OpenAI-kompatibel?

Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.

Weitere Modelle von Mistral

Ministral 3 3B Instruct 2512 ONNX

[!Tip] This model was contributed by Xenova from Hugging Face. We sincerely appreciate the integration and community collaboration. While preliminary functionality checks have been performed, comprehensive testing has not yet been completed. We recommend you to proceed with caution and conducting your own evaluations for specific use cases. If any issues arise, open a PR/Issue here and we will try to address them promptly.

3B 262K Kontext Modell ansehen →
Voxtral 4B TTS 2603

Voxtral TTS is a frontier, open-weights text-to-speech model that’s fast, instantly adaptable, and produces lifelike speech for voice agents. The model is released with BF16 weights and a set of reference voices. These voices are licensed under CC BY-NC 4, which is the license that the model inherits.

4B Modell ansehen →
Mistral 7B Instruct v0.2

py from mistralcommon.tokens.tokenizers.mistral import MistralTokenizer from mistralcommon.protocol.instruct.messages import UserMessage from mistralcommon.protocol.instruct.request import ChatCompletionRequest

7.2B 33K Kontext Modell ansehen →
Mistral 7B Instruct v0.1

py from mistralcommon.tokens.tokenizers.mistral import MistralTokenizer from mistralcommon.protocol.instruct.messages import UserMessage from mistralcommon.protocol.instruct.request import ChatCompletionRequest

7.2B 33K Kontext Modell ansehen →
Mistral 7B v0.1

The Mistral-7B-v0.1 Large Language Model (LLM) is a pretrained generative text model with 7 billion parameters. Mistral-7B-v0.1 outperforms Llama 2 13B on all benchmarks we tested.

7.2B 33K Kontext Modell ansehen →

Testen Sie Mistral Nemo 12B kostenlos

Die Kontoerstellung dauert eine Minute. Testen Sie Mistral Nemo 12B direkt im Playground.

Kostenlos starten