Skip to main content
Flatkey stellt zwei Bild-API-Familien bereit. Verwenden Sie die OpenAI-kompatiblen Endpunkte /v1/images/generations und /v1/images/edits für gpt-image-2. Verwenden Sie den nativen Gemini-Endpunkt generateContent für Gemini-Bildmodelle.
Sie können Gemini-Bildmodelle nicht mit dem OpenAI Images SDK, /v1/images/generations oder /v1/images/edits aufrufen. Verwenden Sie die nativen Gemini-API-Beispiele auf dieser Seite. Andernfalls kann die Anfrage get_channel_failed zurückgeben.

Unterstützte Bildmodelle

Die vollständige Modellliste und aktuelle Preise finden Sie im Modellverzeichnis.

gpt-image-2 verwenden

Das OpenAI SDK verwenden

Ein Bild mit curl generieren

Dieser Endpunkt gibt das generierte Bild in data[0].b64_json zurück; gpt-image-2 stellt keine gehostete Bild-URL bereit. Alle Felder finden Sie in der Images-API-Referenz.

Ein Bild mit curl bearbeiten

Verwenden Sie /v1/images/edits, um ein Eingabebild zusammen mit Bearbeitungsanweisungen hochzuladen. Dieser Endpunkt verwendet multipart/form-data; image ist erforderlich, mask ist optional.
image unterstützt PNG, JPEG und WebP. Lassen Sie mask weg, um das gesamte Bild anhand des Prompts zu bearbeiten. Wenn eine Maske angegeben wird, kennzeichnen ihre transparenten Bereiche die Regionen, die neu gezeichnet werden sollen. Das bearbeitete Bild wird in data[0].b64_json zurückgegeben. Alle Felder finden Sie in der Bearbeitungs-API-Referenz.

Gemini-Bildmodelle verwenden

Gemini-Bildmodelle verwenden den folgenden Endpunkt. Ersetzen Sie {model} durch eine Modell-ID:
Die Anfrage muss "IMAGE" in generationConfig.responseModalities enthalten. Generierte Bilder werden in candidates[].content.parts[].inlineData zurückgegeben.

curl verwenden

Python verwenden und das Bild speichern

Installieren Sie einen HTTP-Client:

Node.js verwenden und das Bild speichern

Gemini-Anforderungsfelder

array
erforderlich
Gesprächsinhalt. Für die Text-zu-Bild-Generierung geben Sie die Bildbeschreibung in parts[].text an.
array
erforderlich
Antwort-Modalitäten. Verwenden Sie ["TEXT", "IMAGE"] für Text und Bilder oder ["IMAGE"], um nur Bilder anzufordern.
string
erforderlich
Die Modell-ID erscheint im URL-Pfad, nicht im Anfrage-Body. Zum Beispiel gemini-3-pro-image.

Gemini-Antwortformat

inlineData.data enthält das base64-kodierte Bild. Eine Antwort kann Text und mehrere Bildteile enthalten. Iterieren Sie über parts, anstatt anzunehmen, dass das Bild immer das erste Element ist.

Fehlerbehebung

Die API gibt get_channel_failed zurück

Stellen Sie sicher, dass der Endpunkt zum Modell passt:
  • Verwenden Sie /v1/images/generations, um mit gpt-image-2 zu generieren.
  • Verwenden Sie /v1/images/edits, um mit gpt-image-2 zu bearbeiten.
  • Verwenden Sie /v1beta/models/{model}:generateContent für Gemini-Bildmodelle.

Die Gemini-Antwort enthält kein Bild

Stellen Sie sicher, dass generationConfig.responseModalities den Wert "IMAGE" enthält. Prüfen Sie die Antwort außerdem auf einen Fehler oder eine Sicherheitssperre.

Effektive Prompts schreiben

  • Geben Sie den Stil an: fotorealistisch, Ölgemälde, Aquarell, 3D-Rendering
  • Fügen Sie Beleuchtungsdetails hinzu: goldene Stunde, Studiobeleuchtung, dramatische Schatten
  • Geben Sie die Komposition an: Nahaufnahme, Weitwinkel, Vogelperspektive, Hochformat
  • Fügen Sie Qualitätsmodifikatoren hinzu: sehr detailliert, 4K, professionelle Fotografie