The Sovereign
AI Gateway.

Single API, Multi-Model Access, Zero Legal Backlog.

Das europäische Control Plane für regulierte KI-Workflows. Mit einer Zeile Code tauschst Du einfach deinen OpenAI oder Anthropic kompatiblen Endpunkt gegen unseren — dahinter liegen souveräne EU-Anbieter und Enterprise-Hyperscaler, physisch und rechtlich abgesichert bis zum Rechenzentrum.

Souveränes Modell-Routing Eine OpenAI-kompatible Anfrage erreicht noirdoc und wird zu EU-Anbietern geroutet: Azure, AKI.IO, IONOS — weitere folgen. Anfrage noirdoc Azure AKI.IO IONOS + EU-Anbieter
API-Key für alle verfügbaren Modelle
1 API-Key für alle verfügbaren Modelle
Zeile Code zur Integration
1 Zeile Code zur Integration
Monate Wartezeit auf unsere Verträge
0 Monate Wartezeit auf unsere Verträge

Architektur

In 5 Minuten integriert. Zero Legal Backlog.

Unsere Architektur funktioniert wie ein Router mit einer eingebauten Firewall. Ohne Vendor-Lock-in und Cloud-Migration. Dafür eine einheitliche Abrechnung für alle Modelle.

01 Control Plane

Souverän ab dem ersten Byte.

Jede Anfrage landet zuerst bei uns, auf unserer deutschen Infrastruktur. Hier laufen Authentifizierung, Freigabeprüfungen und Protokollierung — erst danach entscheiden wir, welches Modell aus welchem Rechenzentrum angesprochen wird.

02 Routing

Multi-Cloud, ohne Migration.

Wohin die Anfrage gehen darf, entscheidest du selbst anhand deiner eigenen Richtlinien — pro Key oder pro Aufruf. Fällt ein Anbieter aus, übernehmen wir den Redirect.

Azure Logo Azure EU AKI.IO Logo AKI.IO EU IONOS Logo IONOS DE Telekom bald Google Vertex bald Regolo.ai bald Weber Cloud bald Infercom bald TensorX bald
03 Compliance

Eigene Regeln pro Key.

Mit jedem neuen Key kannst du die Compliance-Regeln so einstellen, wie dein Team oder dein Kunde sie braucht. Volle Compliance-Kontrolle.

key_mandanten nur DE-Anbieter
key_marketing alle Anbieter
04 Auswahl

Frontier und Open Weights.

Durch unser breites Portfolio hast du die volle Auswahl, das richtige Modell für den jeweiligen Task zu nutzen. Kimi K2.7-Code fürs Coding, GPT-5.6 für das Marketing und Qwen 3.6 für den Sales-Agent? Kein Problem.

05 Failover

Wir kümmern uns um deine Uptime.

Fällt ein Anbieter aus, oder brauchst du einfach mehr Token pro Sekunde als üblich, verteilen wir die Last automatisch anhand deiner Compliance-Einstellungen.

Modelle & Provider

Ein Zugang zu einer großen Modellauswahl.

Die OpenAI-kompatible API ermöglicht den Zugriff auf Modelle verschiedener Provider — mit transparenter Datenresidenz. Wir ersetzen eigene Konten und Verträge durch einen zentralisierten Zugang.

Microsoft Azure Logo
Microsoft Azure Frontier · OpenAI
GPT-5.4 GPT-5 mini
Datenresidenz
EU · EU Data Zone
AKI.IO Logo
AKI.IO Open-Weight · EU
Apertus 70B Mistral 4 119B GPT-OSS 120B
Datenresidenz
EU · EU/EEA-Rechenzentren
IONOS AI Model Hub Logo
IONOS AI Model Hub Open-Weight · DE
Llama 3.1 405B Mistral Small 24B GPT-OSS 120B Qwen3-Coder-Next 80B
Datenresidenz
DE · Deutschland (Berlin)
Zu den Preisen →

Integration

Drop-In Replacement für alle OpenAI kompatible Anwendungen.

Nach einmaliger Konfiguration übernehmen wir das Routing, alles andere ist wie gehabt.

  • Kompatibel mit allen OpenAI-SDKs
  • Keys können auf Provider und/oder Modelle beschränkt werden
  • Smartes Routing inklusive
Zur Quickstart-Doku →
python · openai sdk api.noirdoc.de/v1
from openai import OpenAI

client = OpenAI(
    # eine Zeile — mehr nicht
    base_url="https://api.noirdoc.de/v1",
    api_key=os.environ["NOIRDOC_KEY"],
)

response = client.chat.completions.create(
    model="gpt-5.4",  # ← Anbieter & Modell: ein Feld
    messages=[{"role": "user", "content": "Hallo"}],
)

Zero Legal Backlog

Du musst uns nichts verheimlichen.

Wer Prompts schwärzen, Namen löschen und Kontext weglassen muss, bekommt nur halb so gute Antworten. Durch unsere Zero-Retention-Policy und Verschwiegenheitsvereinbarungen mit unseren Providern musst du das nicht. Denn es liest keiner mit, und trainiert wird mit deinen Daten auch nicht. Dadurch nutzt du das volle Potenzial der KI.

§ 203 StGB

Wir verraten nichts.

Die Schweigepflicht-Vereinbarung ist im Vertragswerk verankert — mit uns, unseren Mitarbeitern, unseren Rechenzentren und den meisten Anbietern im Katalog. Fehlt die Vereinbarung, filtern wir den Anbieter raus. Damit darf uns sogar Dein Anwalt nutzen.

Zero Retention

Wir behalten nichts.

Wir und die Provider speichern keine Inhalte und trainieren nichts mit deinen Daten. Weicht ein Provider davon ab, weisen wir es entsprechend aus.

Optionale Maskierung

Wir verheimlichen für Dich.

Namen, IBANs, Aktenzeichen und weitere sensible Daten werden vor dem Versand an die KI ersetzt und in der Antwort wieder eingefügt. Aber nur wenn du uns explizit darum bittest.

PII-Maskierung Content Filter
Mask Docs →

Nachweis

Und geben dir den Nachweis.

Wann du welchen Anbieter und welches Modell aus welcher Region verwendet hast — darüber bekommst du ein transparentes Protokoll. Den Inhalt davon kennst nur Du.

Ein Ansprechpartner deutsches Recht, einheitliche Abrechnung inklusive
Für alle Verträge AVVs, Verschwiegenheitserklärungen und Zertifikate inklusive

Preise

Für Dich ist unser Service kostenlos.

Wir berechnen die regulären Listenpreise der Anbieter. Du sparst, indem du für jede Aufgabe das passende Modell nutzt.

21 Modelle

Input / Output · € · 1M Token
GPT-5.6 Sol Microsoft Azure EU-Datenresidenz

Stärkstes Modell der GPT-5.6-Familie — extended Reasoning, agentische Workflows und Code für anspruchsvollste Workloads.

4,83 / 28,97
GPT-5.6 Terra Microsoft Azure EU-Datenresidenz

Ausgewogenes Modell der 5.6-Familie — Leistung auf GPT-5.5-Niveau zu deutlich geringeren Kosten.

2,42 / 14,49
GPT-5.6 Luna Microsoft Azure EU-Datenresidenz

Schnellstes und günstigstes 5.6-Modell — für hohe Volumina und latenzkritische Anwendungen.

0,97 / 5,80
GPT-5.4 Microsoft Azure EU-Datenresidenz

Frontier-Modell für anspruchsvolles Reasoning, agentische Workflows und komplexe Produktionslasten.

2,42 / 14,49
GPT-5.4 mini Microsoft Azure EU-Datenresidenz

Kompakte GPT-5.4-Variante für hohe Durchsätze zu geringen Kosten — solide bei Standardaufgaben.

0,73 / 4,35
GPT-5 mini Microsoft Azure EU-Datenresidenz

Kompakte GPT-5-Variante für hohe Durchsätze zu geringen Kosten — solide bei Standardaufgaben.

0,25 / 1,94
Qwen3-Coder-Next (80B) IONOS Deutsche Rechenzentren

Spezialisiertes Code-Modell für Generierung, Refactoring und agentische Dev-Workflows.

0,15 / 0,80
FLUX.1 [schnell] IONOS Deutsche Rechenzentren

Schnelle Text-zu-Bild-Generierung — Abrechnung je erzeugtem Bild.

0,029 pro Bild
FLUX.2 [klein] IONOS Deutsche Rechenzentren

Neue FLUX-Generation für Text-zu-Bild — Abrechnung je Megapixel.

0,013 pro erste Mpx
Flux.2 [klein] bald AKI.IO EU-Rechenzentren

Schnelle Bildgenerierung der FLUX-Reihe — Abrechnung je Megapixel.

0,005 pro 1 Mpx
Qwen Image bald AKI.IO EU-Rechenzentren

Text-zu-Bild mit guter Prompttreue und sauberer Textwiedergabe im Bild.

0,075 pro 1 Mpx
Qwen Image Edit bald AKI.IO EU-Rechenzentren

Bildbearbeitung per Prompt — gezielte Änderungen an bestehenden Bildern.

0,12 pro 1 Mpx
Z-Image Turbo bald AKI.IO EU-Rechenzentren

Sehr günstige, schnelle Bildgenerierung für Prototyping und hohe Volumina.

0,009 pro 1 Mpx
paraphrase-multilingual-mpnet-base-v2 IONOS Deutsche Rechenzentren

Mehrsprachige Embeddings für Ähnlichkeitssuche und RAG — sehr günstig.

0,01 pro 1M Token
bge-large-en-v1.5 IONOS Deutsche Rechenzentren

Starke englische Embeddings für hochwertige Retrieval-Pipelines.

0,015 pro 1M Token
bge-m3 IONOS Deutsche Rechenzentren

Mehrsprachiges Embedding-Modell mit langem Kontext — vielseitig für RAG.

0,02 pro 1M Token
Qwen3-VL Embedding-8B IONOS Deutsche Rechenzentren

Großes multimodales Embedding-Modell für anspruchsvolle Such- und RAG-Anwendungen.

0,10 pro 1M Token
Qwen3-VL Reranker-8B IONOS Deutsche Rechenzentren

Reranker für präzisere Treffer in RAG-Pipelines — ordnet Suchergebnisse neu.

0,04 pro 1M Token
Aufschlag, Grundgebühr, Mindestabnahme
0 € Aufschlag, Grundgebühr, Mindestabnahme
für die Verträge — AVV und §203 liegen bei
0 € für die Verträge — AVV und §203 liegen bei
Base-URL zurücktauschen, fertig
Kein Lock-in Base-URL zurücktauschen, fertig

Unser Angebot richtet sich ausschließlich an Gewerbetreibende, nicht an Endverbraucher. Alle Preise verstehen sich zuzüglich gesetzlicher Umsatzsteuer.

Was uns antreibt

Souverän sein, bedeutet
nicht abhängig zu sein.

Künstliche Intelligenz entscheidet künftig mit — über Prozesse, Mandate, Diagnosen, ganze Branchen. Wer sie unkontrolliert nutzt, liefert sich mit seinen Daten und Know-How an wenige Konzerne außerhalb Europas aus.

Fortschritt darf keine Frage der Abhängigkeit sein. Deshalb bauen wir noirdoc — von München aus, damit jedes Unternehmen KI sicher und flexibel einsetzen kann.

Kontakt

Bereit für den nächsten Schritt?

Egal welche Modelle und welche Residenz du brauchst — wir machen es möglich.

hello@noirdoc.de

Wir antworten in der Regel innerhalb eines Werktags.