Skip to main content
Base URL : https://router.flatkey.ai La génération de texte passe par POST /v1/chat/completions, qui correspond exactement à l’API OpenAI Chat Completions. Tout client compatible OpenAI fonctionne après avoir changé la base URL.

Aucune réécriture nécessaire

Conservez votre code de requête existant et faites pointer base_url vers https://router.flatkey.ai/v1.

Une clé, tous les modèles

Changez de modèle en modifiant le champ model. Rien d’autre ne change.

Effectuer votre premier appel

Choisir un modèle

Listez tout ce que votre compte peut atteindre et conservez les modèles de texte :
Parcourez la même liste avec les tarifs, la longueur du contexte et la latence dans le répertoire des modèles. Un point de départ pratique :

Streamer la réponse

Définissez stream: true pour recevoir les tokens au fur et à mesure qu’ils sont produits :
Chaque chunk contient un delta partiel au lieu d’un message complet.

Appeler vos propres fonctions

Passez des définitions d’outils et le modèle décide quand les invoquer :
Pour terminer la boucle, ajoutez le message de l’assistant, puis un message par résultat d’outil identifié par tool_call_id, et renvoyez l’intégralité du fil.
Lorsqu’un outil se déclenche, finish_reason vaut tool_calls, et non stop. Un code qui vérifie uniquement stop ignorera silencieusement l’appel.
L’appel d’outils est une capacité du modèle, pas de Flatkey. Les familles GPT, Claude, Gemini, Qwen, DeepSeek et GLM le supportent. Les modèles d’image, de vidéo et de parole ignorent un tableau tools.

Forcer un format JSON

Utilisez response_format lorsque vous devez analyser la réponse :
{"type": "json_object"} fonctionne également lorsque vous avez seulement besoin d’un JSON valide sans schéma fixe.

Lire l’usage en tokens

Chaque réponse contient les comptages sur lesquels vous êtes facturé :
Les différentes familles de modèles tokenisent différemment, donc le même texte coûte un nombre différent de tokens selon les modèles. Utilisez usage plutôt que d’estimer à partir du nombre de caractères. Le coût par requête apparaît également dans les journaux d’utilisation.

Dépannage

No available channel for model ... Ce modèle n’est pas routable pour l’instant. Choisissez un autre identifiant dans /v1/models. Relancer la même requête avec le même modèle ne résout pas ce problème. La réponse s’arrête en milieu de phrase finish_reason vaut length. Augmentez max_tokens. Les appels d’outils ne se déclenchent jamais Vérifiez que le modèle supporte les outils, et assurez-vous que tool_choice n’est pas défini à none.

Étapes suivantes

Référence API

Tous les paramètres et champs de réponse.

Guide du SDK OpenAI

Intégrez Flatkey dans un projet OpenAI existant.