Skip to main content
Le point de terminaison /v1/chat/completions génère une complétion de texte à partir d’une liste de messages. C’est le point de terminaison principal pour le chat, le suivi d’instructions et les tâches de génération de texte. Le format de la requête est identique à celui de l’API OpenAI Chat Completions, de sorte que tout SDK compatible OpenAI fonctionne sans modification.

Point de terminaison

Requête

En-têtes

Paramètres du corps

string
requis
L’identifiant du modèle à utiliser. Consultez le Répertoire des modèles pour toutes les valeurs valides. Exemple : "gpt-4o", "claude-sonnet-4-5", "gemini-2.5-flash".
array
requis
Un tableau d’objets de messages représentant la conversation. Chaque objet doit avoir un role ("system", "user" ou "assistant") et un content (chaîne de caractères).
integer
Nombre maximum de tokens à générer. Les valeurs par défaut varient selon le modèle.
number
Température d’échantillonnage entre 0 et 2. Des valeurs plus élevées produisent une sortie plus aléatoire. Par défaut : 1.
boolean
Si true, la réponse est retournée sous forme de flux d’événements envoyés par le serveur (SSE). Par défaut : false.
number
Échantillonnage nucléaire — seuls les tokens dans la masse de probabilité top_p supérieure sont pris en compte. Par défaut : 1.
string | array
Une ou plusieurs séquences où le modèle arrête de générer. Peut être une chaîne de caractères ou un tableau de chaînes.
array
Une liste de définitions d’outils pour l’appel de fonctions. Chaque outil doit avoir type: "function" et un objet function avec name, description et parameters.
string | object
Contrôle la sélection des outils : "none", "auto", "required", ou un outil spécifique {"type": "function", "function": {"name": "..."}}.

Exemple de requête

Réponse

Champs de la réponse

string
Identifiant unique de la complétion.
array
Tableau des choix de complétion générés.
object
Nombre de tokens pour la facturation.

Streaming

Définissez stream: true pour recevoir un flux de fragments SSE. Chaque fragment a la même structure, mais avec un contenu delta partiel à la place d’un message complet :
python