Gemma 4 26B A4B.
Gemma 4 26B A4B ist das offene Mixture-of-Experts-Modell von Google DeepMind mit 25 Milliarden Parametern, von denen rund 4 Milliarden je Token aktiv sind. Es verarbeitet Text, Bilder und kurze Videos, bietet 256K Kontext, natives Function-Calling und einen zuschaltbaren Thinking-Modus.
- Rechenzentren in der EU
- § 203 Verschwiegenheit
- Zero Retention
- Listenpreise
from openai import OpenAI
client = OpenAI(
# eine Zeile — mehr nicht
base_url="https://api.noirdoc.de/v1",
api_key=os.environ["NOIRDOC_KEY"],
)
response = client.chat.completions.create(
model="gemma4-chat-26b", # Anbieter & Modell
messages=[{"role": "user", "content": "Hallo"}],
) Anbieter.
Gemma 4 26B A4B bieten wir über diese Anbieter an.
Governance.
Je API-Key legst du fest, welche Anbieter, Regionen und Modelle erlaubt sind.
So sieht das im Account aus →- Region
-
EU über AKI.IO
- § 203 StGB
-
Verschwiegenheit vereinbart bei AKI.IO
Ein Key mit der Regel „nur mit § 203-Vereinbarung“ kann dieses Modell nutzen.
- Gewichte
-
Open-Weight
Ein Key mit der Regel „nur Open Source“ kann dieses Modell nutzen.
Weitere Modelle.
Googles Flash-Modell der aktuellen Gemini-Generation — auf Tempo und hohe Durchsätze ausgelegt.
Kompakte Flash-Variante für einfache, sehr häufige Aufgaben — auf niedrige Latenz getrimmt.
Ältere Flash-Lite-Generation — stabil für bestehende Integrationen und einfache Massenaufgaben.
Googles offene Gemma-Reihe in der 31B-Instruct-Variante — solider Generalist für Chat und Textarbeit.
Jetzt loslegen.
Mit 5 € Startguthaben direkt auf alle Modelle zugreifen. Fragen vorab klärt der Vertrieb im Gespräch.