Skip to main content
O endpoint /v1/responses implementa a OpenAI Responses API, que suporta conversas multi-turno com estado e gerenciamento integrado de histórico de conversas. É uma alternativa ao /v1/chat/completions para fluxos de trabalho que exigem o formato de resposta mais recente da OpenAI. Passe um previous_response_id para continuar uma conversa sem reenviar o histórico completo de mensagens.

Endpoint

Quando usar este endpoint

Use /v1/responses se:
  • Sua aplicação é construída sobre a OpenAI Responses API
  • Você precisa de gerenciamento de conversas com estado
  • Você usa o parâmetro previous_response_id para conversas multi-turno
Para a maioria das novas integrações, /v1/chat/completions é o endpoint recomendado e tem suporte mais amplo a modelos.

Requisição

Cabeçalhos

Parâmetros do corpo

string
obrigatório
ID do modelo a ser usado. Apenas modelos que suportam o formato Responses API são válidos aqui.
string | array
obrigatório
A entrada do usuário para este turno. Pode ser uma string ou um array de objetos de conteúdo.
string
Instruções em nível de sistema para o modelo (equivalente à mensagem system nas completions de chat).
string
O id de uma resposta anterior. Quando fornecido, o modelo continua a conversa a partir daquele ponto sem que o cliente precise enviar o histórico.
integer
Número máximo de tokens a gerar.
boolean
Se true, retorna um stream de eventos enviados pelo servidor. Padrão: false.

Exemplo de requisição

python

Multi-turno com previous_response_id

python

Resposta

Campos da resposta

string
Identificador único para esta resposta. Passe-o como previous_response_id para continuar a conversa.
string
Sempre "response".
integer
Timestamp Unix de quando a resposta foi criada.
string
O modelo que gerou a resposta.
array
Array de objetos de saída produzidos pelo modelo.
object
Contagem de tokens para faturamento.