Qwen3-VL Embedding 8B.
Qwen3-VL Embedding 8B ist ein großes multimodales Embedding-Modell für anspruchsvolle Such- und RAG-Anwendungen.
- Rechenzentren in Deutschland
- § 203 Verschwiegenheit
- Zero Retention
- Listenpreise
from openai import OpenAI
client = OpenAI(
# eine Zeile — mehr nicht
base_url="https://api.noirdoc.de/v1",
api_key=os.environ["NOIRDOC_KEY"],
)
response = client.embeddings.create(
model="Qwen/Qwen3-VL-Embedding-8B", # Anbieter & Modell
input="Hallo",
) Anbieter.
Qwen3-VL Embedding 8B bieten wir über diese Anbieter an.
Governance.
Je API-Key legst du fest, welche Anbieter, Regionen und Modelle erlaubt sind.
So sieht das im Account aus →- Region
-
Deutschland über IONOS
- § 203 StGB
-
Verschwiegenheit vereinbart bei IONOS
Ein Key mit der Regel „nur mit § 203-Vereinbarung“ kann dieses Modell nutzen.
- Gewichte
-
Open-Weight
Ein Key mit der Regel „nur Open Source“ kann dieses Modell nutzen.
Weitere Modelle.
Kompaktes Qwen-Modell mit 27B Parametern — ausgewogener Generalist für Chat, Reasoning und Tool-Aufrufe.
Effizientes Qwen-MoE — stark bei Mehrsprachigkeit und Reasoning zu niedrigen Kosten.
Großes Qwen-MoE mit 122B Parametern, davon rund 10B aktiv — starkes Reasoning bei schlankem Rechenaufwand.
Spezialisiertes Code-Modell für Generierung, Refactoring und agentische Dev-Workflows.
Reranker für präzisere Treffer in RAG-Pipelines — ordnet Suchergebnisse neu.
Jetzt loslegen.
Mit 5 € Startguthaben direkt auf alle Modelle zugreifen. Fragen vorab klärt der Vertrieb im Gespräch.