Model garden Router · auf Anfrage Dedicated · verfügbar

Llama 3 3 Nemotron Super 49B v1 5 FP8

Läuft als eigenes dediziertes GPU-Deployment, direkt über den Wizard startbar. Daten bleiben in Europa.

Llama-3.3-Nemotron-Super-49B-v1.5-FP8 is a significantly upgraded version of Llama-3.3-Nemotron-Super-49B-v1 and is a large language model (LLM) which is a derivative of Meta Llama-3.3-70B-Instruct (AKA the reference model). It is a reasoning model that is post trained for reason...

nvidia/Llama-3_3-Nemotron-Super-49B-v1_5-FP8 Auf Anfrage
text->text · nvidia · sovereign EU
Runs on EU infrastructure operated by European companies; US marketplace capacity is never part of this chain. Full chain
50B
Parameter
131K
Kontextfenster
80GB
Minimaler VRAM
POST /api/v1/chat/completions Auf Anfrage

Spezifikationen

Parameter 50B
Kontextfenster 131,072 tokens
Minimaler VRAM 80 GB
Architektur DeciLMForCausalLM (vLLM)
Lizenz other
Modalität text->text
Veröffentlicht July 2025
Anbieter nvidia ↗

Preise

Gemeinsamer Router · pro Token
Auf Anfrage
Nicht über den gemeinsamen Router verfügbar. Preis auf Anfrage als dediziertes GPU-Deployment.
Dediziertes GPU · pro Stunde
ab €2,16 pro Stunde
Eigene vLLM-Instanz in europäischer Cloud (80 GB VRAM), stundenweise abgerechnet.

Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.

Direkt aufrufen

Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/Llama-3_3-Nemotron-Super-49B-v1_5-FP8",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Häufig gestellte Fragen

Kann ich Llama 3 3 Nemotron Super 49B v1 5 FP8 in der EU betreiben?

Ja. HostYourAI betreibt Llama 3 3 Nemotron Super 49B v1 5 FP8 auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.

Ist das Hosting von Llama 3 3 Nemotron Super 49B v1 5 FP8 DSGVO-konform?

Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.

Was kostet Llama 3 3 Nemotron Super 49B v1 5 FP8?

Llama 3 3 Nemotron Super 49B v1 5 FP8 ist auf Anfrage verfügbar: über den gemeinsamen EU-Router nach kurzer Abstimmung oder als dediziertes GPU-Deployment, das pro Stunde abgerechnet wird. Nennen Sie uns Ihren Anwendungsfall, dann richten wir es für Sie ein.

Ist die API OpenAI-kompatibel?

Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.

Weitere Modelle von NVIDIA

Testen Sie Llama 3 3 Nemotron Super 49B v1 5 FP8 kostenlos

Die Kontoerstellung dauert eine Minute. Testen Sie Llama 3 3 Nemotron Super 49B v1 5 FP8 direkt im Playground.

Kostenlos starten