/v1/images/generations e /v1/images/edits compatíveis com OpenAI para gpt-image-2. Use o endpoint nativo generateContent do Gemini para modelos de imagem Gemini.
Modelos de imagem suportados
Consulte o Diretório de Modelos para a lista completa de modelos e preços atuais.
Usar gpt-image-2
Usar o SDK da OpenAI
Gerar uma imagem com curl
data[0].b64_json; gpt-image-2 não fornece uma URL de imagem hospedada. Consulte a referência da API de Imagens para todos os campos.
Editar uma imagem com curl
Use/v1/images/edits para enviar uma imagem de entrada junto com instruções de edição. Este endpoint usa multipart/form-data; image é obrigatório e mask é opcional.
image suporta PNG, JPEG e WebP. Omita mask para editar a imagem inteira com base no prompt. Quando uma máscara é fornecida, suas áreas transparentes identificam as regiões a redesenhar. A imagem editada é retornada em data[0].b64_json. Consulte a referência da API de edição para todos os campos.
Usar modelos de imagem Gemini
Os modelos de imagem Gemini usam o endpoint a seguir. Substitua{model} por um ID de modelo:
"IMAGE" em generationConfig.responseModalities. As imagens geradas são retornadas em candidates[].content.parts[].inlineData.
Usar curl
Usar Python e salvar a imagem
Instale um cliente HTTP:Usar Node.js e salvar a imagem
Campos da requisição Gemini
array
obrigatório
Conteúdo da conversa. Para geração de imagem a partir de texto, coloque a descrição da imagem em
parts[].text.array
obrigatório
Modalidades de resposta. Use
["TEXT", "IMAGE"] para texto e imagens, ou ["IMAGE"] para solicitar apenas imagens.string
obrigatório
O ID do modelo aparece no caminho da URL, não no corpo da requisição. Por exemplo,
gemini-3-pro-image.Formato de resposta do Gemini
inlineData.data contém a imagem codificada em base64. Uma resposta pode conter texto e múltiplas partes de imagem. Itere sobre parts em vez de presumir que a imagem é sempre o primeiro item.Solução de problemas
A API retorna get_channel_failed
Certifique-se de que o endpoint corresponde ao modelo:- Use
/v1/images/generationspara gerar comgpt-image-2. - Use
/v1/images/editspara editar comgpt-image-2. - Use
/v1beta/models/{model}:generateContentpara modelos de imagem Gemini.
A resposta do Gemini não contém uma imagem
Certifique-se de quegenerationConfig.responseModalities contém "IMAGE". Verifique também a resposta em busca de erros ou bloqueio de segurança.
Escrever prompts eficazes
- Especifique o estilo: fotorrealista, pintura a óleo, aquarela, renderização 3D
- Inclua detalhes de iluminação: hora dourada, iluminação de estúdio, sombras dramáticas
- Especifique a composição: close-up, ângulo amplo, vista aérea, orientação retrato
- Adicione modificadores de qualidade: altamente detalhado, 4K, fotografia profissional