Model garden Router · warm Dedicated · auf Anfrage

GPT-OSS 120B

Sofort über den EU-Router oder als dediziertes GPU-Deployment. Ihre Daten bleiben in Europa.

GPT-OSS 120B ist ein quelloffenes Sprachmodell von Gpt-oss-120b mit einem Kontextfenster von 131K Tokens, gehostet auf europäischen GPUs über eine OpenAI-kompatible API.

gpt-oss-120b vLLM ready
text->text · open weights · EU-hosted
Parameter
131K
Kontextfenster
80GB
Minimaler VRAM
POST /api/v1/chat/completions 200 OK

Spezifikationen

Kontextfenster 131,072 tokens
Minimaler VRAM 80 GB
Modalität text->text

Preise

Gemeinsamer Router · pro Token
€0.30
Input (pro 1M Tokens)
€1.20
Output (pro 1M Tokens)
Dediziertes GPU · pro Stunde
Auf Anfrage
Dediziertes Deployment, ab 80 GB VRAM. Abrechnung nach GPU-Stunden.

Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.

✓ Funktionsfähig verifiziert am 21-07-2026, Antwort in ms auf unserer EU-Infrastruktur.

Direkt aufrufen

Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-oss-120b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Häufig gestellte Fragen

Kann ich GPT-OSS 120B in der EU betreiben?

Ja. HostYourAI betreibt GPT-OSS 120B auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.

Ist das Hosting von GPT-OSS 120B DSGVO-konform?

Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.

Was kostet GPT-OSS 120B?

Über den gemeinsamen EU-Router zahlen Sie €0.30 pro Million Input-Tokens und €1.20 pro Million Output-Tokens, ohne Fixkosten. Für hohe Volumen oder Isolation können Sie GPT-OSS 120B auch als dedizierte GPU-Instanz stundenweise betreiben.

Ist die API OpenAI-kompatibel?

Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.

Weitere Modelle von Glm-5.2

Testen Sie GPT-OSS 120B kostenlos

Die Kontoerstellung dauert eine Minute. Testen Sie GPT-OSS 120B direkt im Playground.

Kostenlos starten