https://router.flatkey.ai
La generación de texto funciona a través de POST /v1/chat/completions, que coincide exactamente con la API Chat Completions de OpenAI. Cualquier cliente compatible con OpenAI funciona tras cambiar la base URL.
Sin necesidad de reescribir
Mantén tu código de solicitud existente y apunta
base_url a https://router.flatkey.ai/v1.Una clave, todos los modelos
Cambia de modelo modificando el campo
model. Nada más cambia.Haz tu primera llamada
Elige un modelo
Lista todo lo que tu cuenta puede usar y quédate con los modelos de texto:Transmite la respuesta en streaming
Establecestream: true para recibir los tokens a medida que se producen:
delta parcial en lugar de un mensaje completo.
Llama a tus propias funciones
Pasa definiciones de herramientas y el modelo decide cuándo invocarlas:tool_call_id, y envía todo el hilo de vuelta.
La llamada a herramientas es una capacidad del modelo, no de Flatkey. Las familias GPT, Claude, Gemini, Qwen, DeepSeek y GLM la admiten. Los modelos de imagen, vídeo y audio ignoran un array tools.
Fuerza un formato JSON
Usaresponse_format cuando necesites parsear la respuesta:
{"type": "json_object"} también funciona cuando solo necesitas JSON válido sin un esquema fijo.
Lee el uso de tokens
Cada respuesta incluye los recuentos que se te facturan:usage en lugar de estimar a partir del recuento de caracteres. El coste por solicitud también aparece en los registros de uso.
Solución de problemas
No available channel for model ...
Ese modelo no es enrutable en este momento. Elige otro id de /v1/models. Reintentar con el mismo modelo no resuelve esto.
La respuesta se corta a mitad de frase
finish_reason es length. Aumenta max_tokens.
Las llamadas a herramientas nunca se activan
Confirma que el modelo admite herramientas y comprueba que tool_choice no esté establecido en none.
Próximos pasos
Referencia de la API
Todos los parámetros y campos de respuesta.
Guía del SDK de OpenAI
Integra Flatkey en un proyecto OpenAI existente.