Skip to main content
O endpoint /v1/chat/completions gera uma completion de texto com base em uma lista de mensagens. É o endpoint principal para tarefas de chat, seguimento de instruções e geração de texto. O formato da requisição é idêntico ao da API Chat Completions da OpenAI, portanto qualquer SDK compatível com OpenAI funciona sem modificações.

Endpoint

Requisição

Cabeçalhos

Parâmetros do corpo

string
obrigatório
O ID do modelo a ser usado. Consulte o Diretório de Modelos para todos os valores válidos. Exemplo: "gpt-4o", "claude-sonnet-4-5", "gemini-2.5-flash".
array
obrigatório
Um array de objetos de mensagem representando a conversa. Cada objeto deve ter role ("system", "user" ou "assistant") e content (string).
integer
Número máximo de tokens a gerar. Os valores padrão variam por modelo.
number
Temperatura de amostragem entre 0 e 2. Valores mais altos produzem saídas mais aleatórias. Padrão: 1.
boolean
Se true, a resposta é retornada como um stream de eventos enviados pelo servidor (SSE). Padrão: false.
number
Amostragem por núcleo — somente tokens na massa de probabilidade top_p superior são considerados. Padrão: 1.
string | array
Uma ou mais sequências onde o modelo para de gerar. Pode ser uma string ou um array de strings.
array
Uma lista de definições de ferramentas para chamada de funções. Cada ferramenta deve ter type: "function" e um objeto function com name, description e parameters.
string | object
Controla a seleção de ferramentas: "none", "auto", "required" ou uma ferramenta específica {"type": "function", "function": {"name": "..."}}.

Exemplo de requisição

Resposta

Campos da resposta

string
Identificador único para a completion.
array
Array de choices de completion geradas.
object
Contagem de tokens para faturamento.

Streaming

Defina stream: true para receber um stream de chunks SSE. Cada chunk tem a mesma estrutura, mas com conteúdo delta parcial em vez de uma mensagem completa:
python