Skip to main content
O Flatkey oferece duas famílias de APIs de imagem. Use os endpoints /v1/images/generations e /v1/images/edits compatíveis com OpenAI para gpt-image-2. Use o endpoint nativo generateContent do Gemini para modelos de imagem Gemini.
Não é possível chamar modelos de imagem Gemini com o SDK OpenAI Images, /v1/images/generations ou /v1/images/edits. Use os exemplos da API nativa do Gemini nesta página. Caso contrário, a requisição pode retornar get_channel_failed.

Modelos de imagem suportados

Consulte o Diretório de Modelos para a lista completa de modelos e preços atuais.

Usar gpt-image-2

Usar o SDK da OpenAI

Gerar uma imagem com curl

Este endpoint retorna a imagem gerada em data[0].b64_json; gpt-image-2 não fornece uma URL de imagem hospedada. Consulte a referência da API de Imagens para todos os campos.

Editar uma imagem com curl

Use /v1/images/edits para enviar uma imagem de entrada junto com instruções de edição. Este endpoint usa multipart/form-data; image é obrigatório e mask é opcional.
image suporta PNG, JPEG e WebP. Omita mask para editar a imagem inteira com base no prompt. Quando uma máscara é fornecida, suas áreas transparentes identificam as regiões a redesenhar. A imagem editada é retornada em data[0].b64_json. Consulte a referência da API de edição para todos os campos.

Usar modelos de imagem Gemini

Os modelos de imagem Gemini usam o endpoint a seguir. Substitua {model} por um ID de modelo:
A requisição deve incluir "IMAGE" em generationConfig.responseModalities. As imagens geradas são retornadas em candidates[].content.parts[].inlineData.

Usar curl

Usar Python e salvar a imagem

Instale um cliente HTTP:

Usar Node.js e salvar a imagem

Campos da requisição Gemini

array
obrigatório
Conteúdo da conversa. Para geração de imagem a partir de texto, coloque a descrição da imagem em parts[].text.
array
obrigatório
Modalidades de resposta. Use ["TEXT", "IMAGE"] para texto e imagens, ou ["IMAGE"] para solicitar apenas imagens.
string
obrigatório
O ID do modelo aparece no caminho da URL, não no corpo da requisição. Por exemplo, gemini-3-pro-image.

Formato de resposta do Gemini

inlineData.data contém a imagem codificada em base64. Uma resposta pode conter texto e múltiplas partes de imagem. Itere sobre parts em vez de presumir que a imagem é sempre o primeiro item.

Solução de problemas

A API retorna get_channel_failed

Certifique-se de que o endpoint corresponde ao modelo:
  • Use /v1/images/generations para gerar com gpt-image-2.
  • Use /v1/images/edits para editar com gpt-image-2.
  • Use /v1beta/models/{model}:generateContent para modelos de imagem Gemini.

A resposta do Gemini não contém uma imagem

Certifique-se de que generationConfig.responseModalities contém "IMAGE". Verifique também a resposta em busca de erros ou bloqueio de segurança.

Escrever prompts eficazes

  • Especifique o estilo: fotorrealista, pintura a óleo, aquarela, renderização 3D
  • Inclua detalhes de iluminação: hora dourada, iluminação de estúdio, sombras dramáticas
  • Especifique a composição: close-up, ângulo amplo, vista aérea, orientação retrato
  • Adicione modificadores de qualidade: altamente detalhado, 4K, fotografia profissional