Authentifizierung und Basis-URL
Greife auf die Nano Banana API zu, indem du deinen Client auf https://api.nanobananaapis.com/v1 richtest. Du benötigst einen gültigen API-Schlüssel im Authorization-Header. Registriere dich auf der API-Schlüssel erhalten-Seite mit nur E-Mail und Passwort, um deinen Schlüssel sofort zu erhalten. Der Schlüssel wird direkt nach der Registrierung angezeigt. Wenn du ihn verlierst, generiere einen neuen über dein Dashboard; der alte Schlüssel funktioniert sofort nicht mehr.
Verwende Bearer YOUR_API_KEY für jede Anfrage. Die Modell-ID ist immer uncensored. Dieser Endpunkt verarbeitet Texteingaben und -ausgaben. Er generiert keine Bilder, Audio oder Video. Für multimodale Pipelines nutze diese API für Prompt-Schreiben, Skriptgenerierung und Nachbearbeitung.
Erste Anfrage
Sende eine Standard-Chat-Vervollständigungsanfrage. Die API unterstützt das OpenAI-Format. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Dieses Beispiel sendet eine einfache Nachricht an das unzensierte Modell.
curl https://api.nanobananaapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Die Antwort enthält den generierten Text. Sie können die Token-Anzahlen im Antworttext überprüfen. Das Kontextfenster beträgt insgesamt 100.000 Token für Prompt und Completion. Halten Sie Ihre Payloads unter 8 MB.
Python SDK Beispiel
Verwenden Sie das offizielle OpenAI Python SDK. Legen Sie die Basis-URL auf den nanobananaapis Endpunkt fest. Übergeben Sie Ihren API-Schlüssel als api_key. Der Client formatiert Anfragen automatisch korrekt. Diese Methode ist ideal für Backend-Skripte, die Text verarbeiten müssen, bevor er an einen Bild- oder Videogenerierungsdienst gesendet wird.
from openai import OpenAI
client = OpenAI(base_url="https://api.nanobananaapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Das SDK übernimmt das Streaming und die Analyse für dich. Du kannst über die Chunks iterieren, wenn du den Streaming-Modus aktivierst. Dieser Ansatz hält deinen Code sauber und kompatibel mit anderen OpenAI-Diensten, falls du später den Anbieter wechselst.
Node-SDK-Beispiel
Das Node.js SDK funktioniert ähnlich. Initialisiere den Client mit deiner Basis-URL und deinem Schlüssel. Rufe die Methode chat.completions.create auf. Dies ist nützlich für serverlose Funktionen oder Webserver, die Skripte dynamisch generieren müssen.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nanobananaapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Stelle sicher, dass du Fehler ordnungsgemäß behandelst. Häufige Fehler sind Authentifizierungsfehler (401), wenn der Schlüssel ungültig oder abgelaufen ist, und Ratenlimits (429), wenn du 300 Anfragen pro Minute überschreitest. Der API-Schlüssel ist mit deinem Konto verknüpft, also schütze ihn in deinen Umgebungsvariablen.
Streaming-Antworten
Aktiviere das Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält einen Teil des generierten Texts. Dies ist essenziell für Echtzeitanwendungen oder bei der Generierung langer Skripte.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Analysiere die SSE-Events auf deiner Client-Seite. Der Stream endet, wenn das Modell mit der Generierung fertig ist oder das Kontextfenster erreicht. Streaming reduziert die wahrgenommene Latenz für Nutzer. Es ändert nichts an den Preisen; du zahlst weiterhin pro Token.
Limits, Fehler und Modelle
Verfügbare Modelle über GET /v1/models prüfen. Das einzige Modell ist uncensored. Das Ratenlimit beträgt 300 Anfragen pro Minute pro Schlüssel. Der Anfragetext muss unter 8 MB liegen. Der Preis beträgt 0,25 $ pro 1 Mio. Input-Token und 1,00 $ pro 1 Mio. Output-Token. Guthaben verfällt nie. Bei Bedarf kannst du ab 10 $ nachladen. Fehler: 401 bei ungültigen Schlüsseln, 402 bei unzureichendem Guthaben, 429 bei Ratenbegrenzung. Es wird keine SLA oder Verfügbarkeitsgarantie gewährt. Das Modell blockt sexuelle Inhalte von Minderjährigen. Andere legale erwachsene oder kontroverse Themen werden nicht abgelehnt.