Model garden Router · warm Dedicated · auf Anfrage

Devstral 2 123B

Sofort über den EU-Router oder als dediziertes GPU-Deployment. Ihre Daten bleiben in Europa.

Devstral 2 123B ist ein quelloffenes Sprachmodell von Devstral-2-123b-instruct-2512 mit einem Kontextfenster von 262K Tokens, gehostet auf europäischen GPUs über eine OpenAI-kompatible API.

devstral-2-123b-instruct-2512 vLLM ready
text->text · open weights · EU-hosted
Parameter
262K
Kontextfenster
250GB
Minimaler VRAM
POST /api/v1/chat/completions 200 OK

Spezifikationen

Kontextfenster 262,144 tokens
Minimaler VRAM 250 GB
Modalität text->text

Preise

Gemeinsamer Router · pro Token
€0.80
Input (pro 1M Tokens)
€4.00
Output (pro 1M Tokens)
Dediziertes GPU · pro Stunde
Auf Anfrage
Dediziertes Deployment, ab 250 GB VRAM. Abrechnung nach GPU-Stunden.

Dieses Modell braucht 250 GB VRAM, also mehrere GPUs. Über den gemeinsamen Router ist der Token-Preis entsprechend hoch. Ab etwa 50 Millionen Tokens pro Monat ist ein dediziertes Deployment günstiger.

Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.

✓ Funktionsfähig verifiziert am 21-07-2026, Antwort in ms auf unserer EU-Infrastruktur.

Direkt aufrufen

Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "devstral-2-123b-instruct-2512",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Häufig gestellte Fragen

Kann ich Devstral 2 123B in der EU betreiben?

Ja. HostYourAI betreibt Devstral 2 123B auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.

Ist das Hosting von Devstral 2 123B DSGVO-konform?

Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.

Was kostet Devstral 2 123B?

Über den gemeinsamen EU-Router zahlen Sie €0.80 pro Million Input-Tokens und €4.00 pro Million Output-Tokens, ohne Fixkosten. Für hohe Volumen oder Isolation können Sie Devstral 2 123B auch als dedizierte GPU-Instanz stundenweise betreiben.

Ist die API OpenAI-kompatibel?

Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.

Weitere Modelle von Glm-5.2

Testen Sie Devstral 2 123B kostenlos

Die Kontoerstellung dauert eine Minute. Testen Sie Devstral 2 123B direkt im Playground.

Kostenlos starten