/v1/images/generations und /v1/images/edits für gpt-image-2. Verwenden Sie den nativen Gemini-Endpunkt generateContent für Gemini-Bildmodelle.
Unterstützte Bildmodelle
Die vollständige Modellliste und aktuelle Preise finden Sie im Modellverzeichnis.
gpt-image-2 verwenden
Das OpenAI SDK verwenden
Ein Bild mit curl generieren
data[0].b64_json zurück; gpt-image-2 stellt keine gehostete Bild-URL bereit. Alle Felder finden Sie in der Images-API-Referenz.
Ein Bild mit curl bearbeiten
Verwenden Sie/v1/images/edits, um ein Eingabebild zusammen mit Bearbeitungsanweisungen hochzuladen. Dieser Endpunkt verwendet multipart/form-data; image ist erforderlich, mask ist optional.
image unterstützt PNG, JPEG und WebP. Lassen Sie mask weg, um das gesamte Bild anhand des Prompts zu bearbeiten. Wenn eine Maske angegeben wird, kennzeichnen ihre transparenten Bereiche die Regionen, die neu gezeichnet werden sollen. Das bearbeitete Bild wird in data[0].b64_json zurückgegeben. Alle Felder finden Sie in der Bearbeitungs-API-Referenz.
Gemini-Bildmodelle verwenden
Gemini-Bildmodelle verwenden den folgenden Endpunkt. Ersetzen Sie{model} durch eine Modell-ID:
"IMAGE" in generationConfig.responseModalities enthalten. Generierte Bilder werden in candidates[].content.parts[].inlineData zurückgegeben.
curl verwenden
Python verwenden und das Bild speichern
Installieren Sie einen HTTP-Client:Node.js verwenden und das Bild speichern
Gemini-Anforderungsfelder
array
erforderlich
Gesprächsinhalt. Für die Text-zu-Bild-Generierung geben Sie die Bildbeschreibung in
parts[].text an.array
erforderlich
Antwort-Modalitäten. Verwenden Sie
["TEXT", "IMAGE"] für Text und Bilder oder ["IMAGE"], um nur Bilder anzufordern.string
erforderlich
Die Modell-ID erscheint im URL-Pfad, nicht im Anfrage-Body. Zum Beispiel
gemini-3-pro-image.Gemini-Antwortformat
inlineData.data enthält das base64-kodierte Bild. Eine Antwort kann Text und mehrere Bildteile enthalten. Iterieren Sie über parts, anstatt anzunehmen, dass das Bild immer das erste Element ist.Fehlerbehebung
Die API gibt get_channel_failed zurück
Stellen Sie sicher, dass der Endpunkt zum Modell passt:- Verwenden Sie
/v1/images/generations, um mitgpt-image-2zu generieren. - Verwenden Sie
/v1/images/edits, um mitgpt-image-2zu bearbeiten. - Verwenden Sie
/v1beta/models/{model}:generateContentfür Gemini-Bildmodelle.
Die Gemini-Antwort enthält kein Bild
Stellen Sie sicher, dassgenerationConfig.responseModalities den Wert "IMAGE" enthält. Prüfen Sie die Antwort außerdem auf einen Fehler oder eine Sicherheitssperre.
Effektive Prompts schreiben
- Geben Sie den Stil an: fotorealistisch, Ölgemälde, Aquarell, 3D-Rendering
- Fügen Sie Beleuchtungsdetails hinzu: goldene Stunde, Studiobeleuchtung, dramatische Schatten
- Geben Sie die Komposition an: Nahaufnahme, Weitwinkel, Vogelperspektive, Hochformat
- Fügen Sie Qualitätsmodifikatoren hinzu: sehr detailliert, 4K, professionelle Fotografie