Läuft als eigenes dediziertes GPU-Deployment, direkt über den Wizard startbar. Daten bleiben in Europa.
This repository contains an FP8 quantized version of the Qwen3-VL-8B-Instruct model. The quantization method is fine-grained fp8 quantization with block size of 128, and its performance metrics are nearly identical to those of the original BF16 model. Enjoy!
Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.
✓ Funktionsfähig verifiziert am 27-07-2026, Antwort in 1108 ms auf unserer EU-Infrastruktur.
Bench ist unser Qualitätsindex für jedes Modell, 0 bis 100. Er stützt sich auf öffentliche Messungen (Epoch AI mit rund 40 Benchmarks, LiveBench, LMArena und weitere) und wird jeden Morgen aktualisiert. Wo niemand misst, steht eine Schätzung mit Bandbreite.
Noch kein öffentlicher Benchmark: geschätzt aus Größe und Veröffentlichungsdatum.
Bandbreite 29,5 bis 52,3
Quellen: Epoch AI ↗ · LiveBench ↗ · LMArena ↗ · Täglich aktualisiert, zuletzt am 05-10-2026
Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.
curl https://hostyourai.com/api/v1/chat/completions \
-H "Authorization: Bearer hyai-..." \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-VL-8B-Instruct-FP8",
"messages": [{"role": "user", "content": "Hello!"}]
}'
Ja. HostYourAI betreibt Qwen3 VL 8B Instruct FP8 auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.
Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.
Qwen3 VL 8B Instruct FP8 ist auf Anfrage verfügbar: über den gemeinsamen EU-Router nach kurzer Abstimmung oder als dediziertes GPU-Deployment, das pro Stunde abgerechnet wird. Nennen Sie uns Ihren Anwendungsfall, dann richten wir es für Sie ein.
Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.
Die Kontoerstellung dauert eine Minute. Testen Sie Qwen3 VL 8B Instruct FP8 direkt im Playground.
Kostenlos starten