/v1/images/generations dan /v1/images/edits yang kompatibel dengan OpenAI untuk gpt-image-2. Gunakan endpoint generateContent Gemini native untuk model gambar Gemini.
Model gambar yang didukung
Lihat Direktori Model untuk daftar model lengkap dan harga terkini.
Gunakan gpt-image-2
Gunakan OpenAI SDK
Buat gambar dengan curl
data[0].b64_json; gpt-image-2 tidak menyediakan URL gambar yang dihosting. Lihat referensi Images API untuk semua field.
Edit gambar dengan curl
Gunakan/v1/images/edits untuk mengunggah gambar masukan beserta instruksi pengeditan. Endpoint ini menggunakan multipart/form-data; image wajib diisi dan mask bersifat opsional.
image mendukung PNG, JPEG, dan WebP. Hilangkan mask untuk mengedit seluruh gambar berdasarkan prompt. Ketika mask diberikan, area transparannya menentukan wilayah yang akan digambar ulang. Gambar yang telah diedit dikembalikan dalam data[0].b64_json. Lihat referensi API edit untuk semua field.
Gunakan model gambar Gemini
Model gambar Gemini menggunakan endpoint berikut. Ganti{model} dengan ID model:
"IMAGE" dalam generationConfig.responseModalities. Gambar yang dihasilkan dikembalikan dalam candidates[].content.parts[].inlineData.
Gunakan curl
Gunakan Python dan simpan gambar
Instal klien HTTP:Gunakan Node.js dan simpan gambar
Field permintaan Gemini
array
wajib
Konten percakapan. Untuk pembuatan gambar dari teks, masukkan deskripsi gambar dalam
parts[].text.array
wajib
Modalitas respons. Gunakan
["TEXT", "IMAGE"] untuk teks dan gambar, atau ["IMAGE"] untuk meminta gambar saja.string
wajib
ID model muncul di path URL, bukan di dalam body permintaan. Contohnya,
gemini-3-pro-image.Format respons Gemini
inlineData.data berisi gambar yang dikodekan dalam base64. Sebuah respons dapat berisi teks dan beberapa bagian gambar. Iterasi melalui parts alih-alih mengasumsikan bahwa gambar selalu berada di item pertama.Pemecahan masalah
API mengembalikan get_channel_failed
Pastikan endpoint sesuai dengan modelnya:- Gunakan
/v1/images/generationsuntuk membuat gambar dengangpt-image-2. - Gunakan
/v1/images/editsuntuk mengedit dengangpt-image-2. - Gunakan
/v1beta/models/{model}:generateContentuntuk model gambar Gemini.
Respons Gemini tidak mengandung gambar
PastikangenerationConfig.responseModalities berisi "IMAGE". Periksa juga respons untuk kesalahan atau pemblokiran keamanan.
Tulis prompt yang efektif
- Tentukan gayanya: fotorealistis, lukisan minyak, cat air, render 3D
- Sertakan detail pencahayaan: cahaya senja, pencahayaan studio, bayangan dramatis
- Tentukan komposisinya: close-up, sudut lebar, pandangan dari atas, orientasi potret
- Tambahkan pengubah kualitas: sangat detail, 4K, fotografi profesional