Skip to main content
Usa /v1/images/generations para generar una imagen a partir de un prompt de texto y /v1/images/edits para editar una imagen de entrada. Ambos endpoints utilizan el formato de solicitud compatible con OpenAI Images. Las operaciones disponibles dependen del modelo y del canal expuesto por tu servicio Flatkey.
Los modelos de imágenes de Gemini usan el endpoint nativo generateContent de Gemini y no pueden invocarse a través de estos endpoints de OpenAI Images. Consulta la guía de modelos de imágenes de Gemini.

Generar una imagen

Endpoint

Cabeceras

Parámetros del cuerpo JSON

string
requerido
ID del modelo de imágenes expuesto por tu servicio Flatkey, como "gpt-image-2".
string
requerido
Descripción en texto de la imagen que se desea generar.
string
Dimensiones de salida, como "1024x1024". Los valores admitidos dependen del modelo.
string
Calidad de salida: "low", "medium" o "high". Si se omite, se usa el valor predeterminado del servicio upstream. Una mayor calidad aumenta la latencia y el consumo.
string
Tratamiento del fondo, como "transparent" u "opaque", cuando el modelo lo admite.
string
Formato de salida, como "png", "jpeg" o "webp", cuando el modelo lo admite.
integer
Nivel de compresión de salida, cuando el modelo lo admite.
string
Nivel de moderación de contenido, cuando el modelo lo admite.
string
Los resultados de gpt-image-2 se devuelven en data[].b64_json. No se proporcionan URLs de imagen alojadas, y response_format: "url" no está disponible.
integer
Número de imágenes solicitadas. gpt-image-2 actualmente devuelve una imagen por solicitud porque su herramienta de imágenes upstream no acepta n. Envía varias solicitudes si necesitas varias imágenes.
boolean
Establece en true para recibir una respuesta SSE. Omítelo para una respuesta síncrona.

Ejemplos de solicitudes

Editar una imagen

/v1/images/edits acepta una imagen de entrada e instrucciones de edición como multipart/form-data.

Endpoint

Cabeceras

Campos del formulario

Ejemplo de solicitud

El campo mask es opcional. Omítelo para editar toda la imagen según el prompt. No establezcas la cabecera Content-Type manualmente; curl deriva el boundary multipart correcto a partir de los campos -F.
Si la máscara proporcionada está dañada, es ilegible o supera el límite del servicio, la solicitud fallará en lugar de recurrir a una edición de toda la imagen.

Respuesta

Las solicitudes de generación y edición síncronas devuelven el mismo formato de respuesta. Flatkey devuelve la imagen como datos en base64; no proporciona una URL de imagen alojada para gpt-image-2.

Campos de la respuesta

integer
Marca de tiempo Unix del momento en que se completó la solicitud.
array
Array de objetos de imagen.
En las ediciones, la imagen de entrada también cuenta para el consumo del modelo, por lo que una edición suele consumir más que una generación de imágenes solo a partir de texto.

Streaming

Establece stream en true en el cuerpo JSON de una generación o añade -F "stream=true" a una solicitud de edición para recibir una salida text/event-stream. El evento final contiene el resultado de la imagen, seguido de data: [DONE]. La compatibilidad con streaming puede depender del modelo y del canal seleccionados. Para solicitudes síncronas de alta calidad, configura un tiempo de espera del cliente de al menos 150 segundos.