Skip to main content
Verwenden Sie /v1/images/generations, um ein Bild aus einer Textbeschreibung zu generieren, und /v1/images/edits, um ein vorhandenes Bild zu bearbeiten. Beide Endpunkte verwenden mit OpenAI Images kompatible Anforderungsformate. Welche Operationen verfügbar sind, hängt vom Modell und dem von Ihrem Flatkey-Dienst bereitgestellten Kanal ab.
Gemini-Bildmodelle verwenden den nativen Gemini-Endpunkt generateContent und können nicht über diese OpenAI-Images-Endpunkte aufgerufen werden. Weitere Informationen finden Sie im Leitfaden für Gemini-Bildmodelle.

Bild generieren

Endpunkt

JSON-Body-Parameter

string
erforderlich
ID des Bildmodells, das von Ihrem Flatkey-Dienst bereitgestellt wird, z. B. "gpt-image-2".
string
erforderlich
Textbeschreibung des zu generierenden Bildes.
string
Ausgabeabmessungen, z. B. "1024x1024". Unterstützte Werte hängen vom Modell ab.
string
Ausgabequalität: "low", "medium" oder "high". Wird dieser Parameter weggelassen, wird der Standard des vorgelagerten Dienstes verwendet. Höhere Qualität erhöht die Latenz und den Verbrauch.
string
Hintergrundverarbeitung, z. B. "transparent" oder "opaque", sofern vom Modell unterstützt.
string
Ausgabeformat, z. B. "png", "jpeg" oder "webp", sofern vom Modell unterstützt.
integer
Komprimierungsstufe der Ausgabe, sofern vom Modell unterstützt.
string
Inhaltsmoderationsstufe, sofern vom Modell unterstützt.
string
gpt-image-2-Ergebnisse werden in data[].b64_json zurückgegeben. Gehostete Bild-URLs werden nicht bereitgestellt, und response_format: "url" wird nicht unterstützt.
integer
Gewünschte Anzahl von Bildern. gpt-image-2 gibt derzeit ein Bild pro Anfrage zurück, da das vorgelagerte Bildwerkzeug n nicht akzeptiert. Senden Sie mehrere Anfragen, wenn Sie mehrere Bilder benötigen.
boolean
Auf true setzen, um eine SSE-Antwort zu erhalten. Weglassen für eine synchrone Antwort.

Beispielanfragen

Bild bearbeiten

/v1/images/edits akzeptiert ein Eingabebild und Bearbeitungsanweisungen als multipart/form-data.

Endpunkt

Header

Formularfelder

Beispielanfrage

Das Feld mask ist optional. Lassen Sie es weg, um das gesamte Bild anhand des Prompts zu bearbeiten. Setzen Sie den Content-Type-Header nicht manuell; curl leitet die korrekte Multipart-Grenze aus den -F-Feldern ab.
Wenn eine bereitgestellte Maske beschädigt oder unleserlich ist oder das Dienstlimit überschreitet, schlägt die Anfrage fehl, anstatt auf eine Bearbeitung des gesamten Bildes zurückzufallen.

Antwort

Synchrone Generierungs- und Bearbeitungsanfragen geben dasselbe Antwortformat zurück. Flatkey gibt das Bild als Base64-Daten zurück; für gpt-image-2 wird keine gehostete Bild-URL bereitgestellt.

Antwortfelder

integer
Unix-Zeitstempel des Anfragezeitpunkts.
array
Array von Bildobjekten.
Bei Bearbeitungen wird auch das Eingabebild auf den Modellverbrauch angerechnet, sodass eine Bearbeitung typischerweise mehr Verbrauch verursacht als eine reine Textgenerierung.

Streaming

Setzen Sie stream auf true im JSON-Body einer Generierungsanfrage oder fügen Sie -F "stream=true" einer Bearbeitungsanfrage hinzu, um eine text/event-stream-Ausgabe zu erhalten. Das letzte Ereignis enthält das Bildergebnis, gefolgt von data: [DONE]. Die Streaming-Unterstützung kann vom ausgewählten Modell und Kanal abhängen. Für synchrone Anfragen mit hoher Qualität konfigurieren Sie ein Client-Timeout von mindestens 150 Sekunden.