Model garden Router · op aanvraag Dedicated · op aanvraag

NVIDIA Nemotron Nano 12B v2 VL NVFP4 QAD

Dit model draait als dedicated deployment op grote GPU's en staat niet standaard in de gedeelde playground. Neem contact op, dan zetten we het voor je klaar.

NVIDIA-Nemotron-Nano-VL-12B-V2-FP4-QAD is the quantized version of the NVIDIA Nemotron Nano VL V2 model, which is an auto-regressive vision language model that uses an optimized transformer architecture. For more information, please check here. The NVIDIA Nemotron Nano VL FP4 QAD...

nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-NVFP4-QAD Op aanvraag
text+image->text · nvidia · EU-hosted
7.7B
Parameters
Contextvenster
16GB
Minimale VRAM
POST /api/v1/chat/completions Op aanvraag

Specificaties

Parameters 7.7B
Minimale VRAM 16 GB
Architectuur NemotronH_Nano_VL_V2 (vLLM)
Licentie other
Modaliteit text+image->text
Uitgebracht October 2025
Uitgever nvidia ↗

Prijzen

Gedeelde router · per token
Op aanvraag
Niet beschikbaar op de gedeelde router. Prijs op aanvraag als dedicated GPU-deployment.
Dedicated GPU · per uur
Op aanvraag
Dedicated deployment, vanaf 16 GB VRAM. Afgerekend per GPU-uur.

Gedeelde EU-router, pay-per-token, scale-to-zero. Dedicated GPU-deployments worden per uur afgerekend, zie prijzen.

Direct aanroepen

Drop-in vervanger voor OpenAI: wijzig alleen de base-URL en de API-key. Ook het Anthropic-formaat (/v1/messages) wordt ondersteund.

curl https://hostyourai.com/api/v1/chat/completions \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-NVFP4-QAD",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Veelgestelde vragen

Kan ik NVIDIA Nemotron Nano 12B v2 VL NVFP4 QAD in de EU draaien?

Ja. HostYourAI draait NVIDIA Nemotron Nano 12B v2 VL NVFP4 QAD op GPU's in Europese datacenters via vLLM. Prompts en outputs verlaten de EU niet en er is geen Amerikaanse cloudprovider in de keten.

Is NVIDIA Nemotron Nano 12B v2 VL NVFP4 QAD hosten AVG/GDPR-compliant?

Ja. Alle verwerking vindt plaats binnen de EU, er is een verwerkersovereenkomst (DPA) beschikbaar en de subprocessor-lijst is openbaar. Open-source gewichten betekenen ook: geen training op jouw data.

Wat kost NVIDIA Nemotron Nano 12B v2 VL NVFP4 QAD?

NVIDIA Nemotron Nano 12B v2 VL NVFP4 QAD is beschikbaar op aanvraag: via de gedeelde EU-router na kort overleg, of als eigen dedicated GPU-deployment per uur. Vertel ons je use case, dan zetten we het voor je klaar.

Is de API compatibel met OpenAI?

Ja. Je gebruikt de standaard OpenAI-SDK's met een aangepaste base-URL (https://hostyourai.com/api/v1). Ook de Anthropic Messages API wordt ondersteund als drop-in.

Andere modellen van NVIDIA

Vraag toegang aan

NVIDIA Nemotron Nano 12B v2 VL NVFP4 QAD is nog niet standaard beschikbaar. Laat je gegevens achter, dan regelen we een dedicated deployment.

Vraag toegang aan