Skip to main content
Base URL: https://router.flatkey.ai Генерация текста выполняется через POST /v1/chat/completions, который полностью соответствует OpenAI Chat Completions API. Любой OpenAI-совместимый клиент работает после смены base URL.

Без переписывания кода

Оставьте существующий код запросов и направьте base_url на https://router.flatkey.ai/v1.

Один ключ — все модели

Переключайте модели, меняя поле model. Всё остальное остаётся без изменений.

Первый запрос

Выбор модели

Получите список всего, что доступно вашему аккаунту, и оставьте только текстовые модели:
Просмотрите тот же список с ценами, длиной контекста и задержкой в каталоге моделей. Практическая отправная точка:

Стриминг ответа

Установите stream: true, чтобы получать токены по мере их генерации:
Каждый чанк содержит частичный delta вместо полного сообщения.

Вызов собственных функций

Передайте определения инструментов, и модель сама решит, когда их вызывать:
Чтобы завершить цикл, добавьте сообщение ассистента, затем по одному сообщению на каждый результат инструмента с ключом tool_call_id и отправьте весь тред обратно.
Когда инструмент срабатывает, finish_reason равен tool_calls, а не stop. Код, проверяющий только stop, молча пропустит вызов.
Вызов инструментов — это возможность модели, а не Flatkey. Семейства GPT, Claude, Gemini, Qwen, DeepSeek и GLM поддерживают его. Модели для изображений, видео и речи игнорируют массив tools.

Принудительная схема JSON

Используйте response_format, когда нужно разбирать ответ:
{"type": "json_object"} также работает, если нужен просто валидный JSON без фиксированной схемы.

Чтение статистики токенов

Каждый ответ содержит счётчики, по которым выставляется счёт:
Разные семейства моделей токенизируют по-разному, поэтому один и тот же текст стоит разное количество токенов на разных моделях. Используйте usage вместо оценки по количеству символов. Стоимость каждого запроса также отображается в журнале использования.

Устранение неполадок

No available channel for model ... Эта модель сейчас недоступна для маршрутизации. Выберите другой идентификатор из /v1/models. Повторный запрос с той же моделью ситуацию не исправит. Ответ обрывается на середине предложения finish_reason равен length. Увеличьте max_tokens. Вызовы инструментов никогда не срабатывают Убедитесь, что модель поддерживает инструменты, и проверьте, что tool_choice не установлен в none.

Дальнейшие шаги

Справочник API

Все параметры и поля ответа.

Руководство по OpenAI SDK

Подключите Flatkey к существующему проекту на OpenAI.