/v1/responses implementa a OpenAI Responses API, que suporta conversas multi-turno com estado e gerenciamento integrado de histórico de conversas. É uma alternativa ao /v1/chat/completions para fluxos de trabalho que exigem o formato de resposta mais recente da OpenAI. Passe um previous_response_id para continuar uma conversa sem reenviar o histórico completo de mensagens.
Endpoint
Quando usar este endpoint
Use/v1/responses se:
- Sua aplicação é construída sobre a OpenAI Responses API
- Você precisa de gerenciamento de conversas com estado
- Você usa o parâmetro
previous_response_idpara conversas multi-turno
/v1/chat/completions é o endpoint recomendado e tem suporte mais amplo a modelos.
Requisição
Cabeçalhos
Parâmetros do corpo
string
obrigatório
ID do modelo a ser usado. Apenas modelos que suportam o formato Responses API são válidos aqui.
string | array
obrigatório
A entrada do usuário para este turno. Pode ser uma string ou um array de objetos de conteúdo.
string
Instruções em nível de sistema para o modelo (equivalente à mensagem
system nas completions de chat).string
O
id de uma resposta anterior. Quando fornecido, o modelo continua a conversa a partir daquele ponto sem que o cliente precise enviar o histórico.integer
Número máximo de tokens a gerar.
boolean
Se
true, retorna um stream de eventos enviados pelo servidor. Padrão: false.Exemplo de requisição
python
Multi-turno com previous_response_id
python
Resposta
Campos da resposta
string
Identificador único para esta resposta. Passe-o como
previous_response_id para continuar a conversa.string
Sempre
"response".integer
Timestamp Unix de quando a resposta foi criada.
string
O modelo que gerou a resposta.
array
Array de objetos de saída produzidos pelo modelo.
object
Contagem de tokens para faturamento.