/v1/chat/completions gera uma completion de texto com base em uma lista de mensagens. É o endpoint principal para tarefas de chat, seguimento de instruções e geração de texto. O formato da requisição é idêntico ao da API Chat Completions da OpenAI, portanto qualquer SDK compatível com OpenAI funciona sem modificações.
Endpoint
Requisição
Cabeçalhos
Parâmetros do corpo
string
obrigatório
O ID do modelo a ser usado. Consulte o Diretório de Modelos para todos os valores válidos. Exemplo:
"gpt-4o", "claude-sonnet-4-5", "gemini-2.5-flash".array
obrigatório
Um array de objetos de mensagem representando a conversa. Cada objeto deve ter
role ("system", "user" ou "assistant") e content (string).integer
Número máximo de tokens a gerar. Os valores padrão variam por modelo.
number
Temperatura de amostragem entre 0 e 2. Valores mais altos produzem saídas mais aleatórias. Padrão: 1.
boolean
Se
true, a resposta é retornada como um stream de eventos enviados pelo servidor (SSE). Padrão: false.number
Amostragem por núcleo — somente tokens na massa de probabilidade
top_p superior são considerados. Padrão: 1.string | array
Uma ou mais sequências onde o modelo para de gerar. Pode ser uma string ou um array de strings.
array
Uma lista de definições de ferramentas para chamada de funções. Cada ferramenta deve ter
type: "function" e um objeto function com name, description e parameters.string | object
Controla a seleção de ferramentas:
"none", "auto", "required" ou uma ferramenta específica {"type": "function", "function": {"name": "..."}}.Exemplo de requisição
Resposta
Campos da resposta
string
Identificador único para a completion.
array
Array de choices de completion geradas.
object
Contagem de tokens para faturamento.
Streaming
Definastream: true para receber um stream de chunks SSE. Cada chunk tem a mesma estrutura, mas com conteúdo delta parcial em vez de uma mensagem completa:
python