Model garden Router · warm Dedicated · verfügbar

bge multilingual gemma2

Sofort über den EU-Router oder als dediziertes GPU-Deployment. Ihre Daten bleiben in Europa.

For more details please refer to our Github: FlagEmbedding.

BAAI/bge-multilingual-gemma2
text->embedding · BAAI · sovereign EU
Runs on EU infrastructure operated by European companies; US marketplace capacity is never part of this chain. Full chain
9.2B
Parameter
8K
Kontextfenster
48GB
Minimaler VRAM
POST /api/v1/embeddings 200 OK

Spezifikationen

Parameter 9.2B
Kontextfenster 8,192 tokens
Minimaler VRAM 48 GB
Architektur Gemma2Model (vLLM)
Lizenz gemma
Modalität text->embedding
Veröffentlicht July 2024
Anbieter BAAI ↗

Preise

Gemeinsamer Router · pro Token
€0.12
Input (pro 1M Tokens)
Dediziertes GPU · pro Stunde
ab €3,04 pro Stunde
Eigene vLLM-Instanz in europäischer Cloud (48 GB VRAM), stundenweise abgerechnet.

Gemeinsamer EU-Router, Pay-per-Token, Scale-to-Zero. Dedizierte GPU-Deployments werden stundenweise abgerechnet, siehe Preise.

Bench-Index

Bench ist unser Qualitätsindex für jedes Modell, 0 bis 100. Er stützt sich auf öffentliche Messungen (Epoch AI mit rund 40 Benchmarks, LiveBench, LMArena und weitere) und wird jeden Morgen aktualisiert. Wo niemand misst, steht eine Schätzung mit Bandbreite.

69,9 / 100 · MTEB

Embedding-Modell, gemessen auf MTEB (eigene Skala).

Quellen: Epoch AI ↗ · LiveBench ↗ · LMArena ↗ · Täglich aktualisiert, zuletzt am 05-10-2026

Direkt aufrufen

Drop-in-Ersatz für OpenAI: Ändern Sie nur die Base-URL und den API-Key. Auch das Anthropic-Format (/v1/messages) wird unterstützt.

curl https://hostyourai.com/api/v1/embeddings \
  -H "Authorization: Bearer hyai-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "BAAI/bge-multilingual-gemma2",
    "input": "The quick brown fox"
  }'

Häufig gestellte Fragen

Kann ich bge multilingual gemma2 in der EU betreiben?

Ja. HostYourAI betreibt bge multilingual gemma2 auf GPUs in europäischen Rechenzentren über vLLM. Prompts und Outputs verlassen die EU nicht und es ist kein US-Cloud-Anbieter in der Kette.

Ist das Hosting von bge multilingual gemma2 DSGVO-konform?

Ja. Die gesamte Verarbeitung findet innerhalb der EU statt, ein Auftragsverarbeitungsvertrag (AVV) ist verfügbar und die Liste der Subprozessoren ist öffentlich. Open-Source-Gewichte bedeuten außerdem: kein Training mit Ihren Daten.

Was kostet bge multilingual gemma2?

Über den gemeinsamen EU-Router zahlen Sie €0.12 pro Million Input-Tokens. Embeddings haben keine Output-Tokens.

Ist die API OpenAI-kompatibel?

Ja. Sie verwenden die Standard-OpenAI-SDKs mit einer angepassten Base-URL (https://hostyourai.com/api/v1). Auch die Anthropic Messages API wird als Drop-in unterstützt.

Weitere Modelle von BAAI

AREX 2

AREX-2 is a 27B-parameter long-horizon agent model from the Beijing Academy of Artificial Intelligence (BAAI). It learns to improve a solution over multiple test-time rounds: propose, measure, reflect, and revise.

27B 262K Kontext Modell ansehen →
Recon2Reason Reasoning 4B

Recon2Reason Reasoning 4B is a 4B-scale vision-language model specialized for spatial reasoning in indoor and embodied scenes. It is fine-tuned from Qwen3-VL-4B and improves reasoning about metric distance, relative position, object configuration, and spatial relations from visual inputs.

4.4B 262K Kontext Modell ansehen →
AREX Base

AREX is a family of deep research agents developed by the Beijing Academy of Artificial Intelligence (BAAI). It is designed for long-horizon tasks in which an agent must search across sources, assemble candidate answers, verify multiple constraints, and revise its research plan when the available evidence is incomplete.

123B 262K Kontext Modell ansehen →
AREX Turbo

AREX is a family of deep research agents developed by the Beijing Academy of Artificial Intelligence (BAAI). It is designed for long-horizon tasks in which an agent must search across sources, assemble candidate answers, verify multiple constraints, and revise its research plan when the available evidence is incomplete.

4.5B 262K Kontext Modell ansehen →
URSA 1.7B IBQ512

Using the 🤗's Diffusers library to run URSA in a simple and efficient manner.

2.3B Modell ansehen →
URSA 0.6B FSQ320

Using the 🤗's Diffusers library to run URSA in a simple and efficient manner.

0.7B Modell ansehen →

Testen Sie bge multilingual gemma2 kostenlos

Die Kontoerstellung dauert eine Minute. Ihr API-Key funktioniert sofort mit bge multilingual gemma2.

Kostenlos starten