Skip to main content
Base URL: https://router.flatkey.ai La generación de texto funciona a través de POST /v1/chat/completions, que coincide exactamente con la API Chat Completions de OpenAI. Cualquier cliente compatible con OpenAI funciona tras cambiar la base URL.

Sin necesidad de reescribir

Mantén tu código de solicitud existente y apunta base_url a https://router.flatkey.ai/v1.

Una clave, todos los modelos

Cambia de modelo modificando el campo model. Nada más cambia.

Haz tu primera llamada

Elige un modelo

Lista todo lo que tu cuenta puede usar y quédate con los modelos de texto:
Explora la misma lista con precios, longitud de contexto y latencia en el directorio de modelos. Un punto de partida práctico:

Transmite la respuesta en streaming

Establece stream: true para recibir los tokens a medida que se producen:
Cada fragmento lleva un delta parcial en lugar de un mensaje completo.

Llama a tus propias funciones

Pasa definiciones de herramientas y el modelo decide cuándo invocarlas:
Para completar el bucle, añade el mensaje del asistente, luego un mensaje por resultado de herramienta identificado por tool_call_id, y envía todo el hilo de vuelta.
Cuando se activa una herramienta, finish_reason es tool_calls, no stop. El código que solo comprueba stop ignorará la llamada silenciosamente.
La llamada a herramientas es una capacidad del modelo, no de Flatkey. Las familias GPT, Claude, Gemini, Qwen, DeepSeek y GLM la admiten. Los modelos de imagen, vídeo y audio ignoran un array tools.

Fuerza un formato JSON

Usa response_format cuando necesites parsear la respuesta:
{"type": "json_object"} también funciona cuando solo necesitas JSON válido sin un esquema fijo.

Lee el uso de tokens

Cada respuesta incluye los recuentos que se te facturan:
Las distintas familias de modelos tokenizan de forma diferente, por lo que el mismo texto cuesta un número diferente de tokens en distintos modelos. Usa usage en lugar de estimar a partir del recuento de caracteres. El coste por solicitud también aparece en los registros de uso.

Solución de problemas

No available channel for model ... Ese modelo no es enrutable en este momento. Elige otro id de /v1/models. Reintentar con el mismo modelo no resuelve esto. La respuesta se corta a mitad de frase finish_reason es length. Aumenta max_tokens. Las llamadas a herramientas nunca se activan Confirma que el modelo admite herramientas y comprueba que tool_choice no esté establecido en none.

Próximos pasos

Referencia de la API

Todos los parámetros y campos de respuesta.

Guía del SDK de OpenAI

Integra Flatkey en un proyecto OpenAI existente.