Skip to main content
使用 /v1/images/generations 根据文本提示词生成图片,使用 /v1/images/edits 根据输入图片和提示词编辑图片。两个端点均采用兼容 OpenAI Images API 的请求格式;具体可用能力取决于 Flatkey 服务实际开放的模型和渠道。
Gemini 图片模型使用 Gemini 原生 generateContent 端点,不能通过这些 OpenAI Images 端点调用。请参阅 Gemini 图片模型操作手册

生成图片

端点

请求头

JSON 请求体参数

string
必填
Flatkey 服务实际开放的图片模型 ID,例如 "gpt-image-2"
string
必填
对要生成图片的文本描述。
string
输出尺寸,例如 "1024x1024"。支持值取决于模型。
string
输出质量:"low""medium""high"。省略时使用上游默认值;质量越高,耗时和用量越大。
string
背景处理,例如 "transparent""opaque",是否支持取决于模型。
string
输出格式,例如 "png""jpeg""webp",是否支持取决于模型。
integer
输出压缩级别,是否支持取决于模型。
string
内容审核档位,是否支持取决于模型。
string
gpt-image-2 的结果固定返回在 data[].b64_json 中,不提供托管图片 URL,也不支持 response_format: "url"
integer
请求的图片数量。gpt-image-2 的上游图片工具目前不接受 n,因此每次请求固定返回一张图片;如需多张,请发起多次请求。
boolean
设置为 true 时返回 SSE 流;省略时返回同步响应。

请求示例

编辑图片

/v1/images/edits 使用 multipart/form-data 上传待编辑图片和编辑指令。

端点

请求头

表单参数

请求示例

mask 是可选参数。省略它即可根据提示词编辑整张图片。不要手动添加 Content-Type 请求头;curl 会根据 -F 参数自动设置正确的 multipart boundary。
如果提供的蒙版已损坏、无法读取或超过服务限制,请求会直接失败,不会退化为整图编辑。

响应

同步生成和编辑请求返回相同的响应结构。Flatkey 以 Base64 数据返回图片;gpt-image-2 不提供托管图片 URL。

响应字段

integer
请求完成时的 Unix 时间戳。
array
图片对象数组。
编辑请求的输入图片也会计入模型用量,因此图片编辑通常比纯文本生成图片消耗更多用量。

流式响应

在生成请求的 JSON 请求体中设置 stream: true,或在编辑请求中添加 -F "stream=true",即可接收 text/event-stream 响应。最终事件包含图片结果,随后返回 data: [DONE] 流式支持情况取决于所选模型和渠道。对于同步的高质量请求,建议将客户端超时设置为至少 150 秒。