Skip to main content
Эндпоинт /v1/chat/completions генерирует текстовое завершение на основе списка сообщений. Это основной эндпоинт для задач чата, следования инструкциям и генерации текста. Формат запроса идентичен OpenAI Chat Completions API, поэтому любой совместимый с OpenAI SDK работает без изменений.

Эндпоинт

Запрос

Заголовки

Параметры тела запроса

string
обязательно
Идентификатор модели для использования. Все допустимые значения см. в каталоге моделей. Пример: "gpt-4o", "claude-sonnet-4-5", "gemini-2.5-flash".
array
обязательно
Массив объектов сообщений, представляющих беседу. Каждый объект должен иметь role ("system", "user" или "assistant") и content (строка).
integer
Максимальное количество токенов для генерации. Значения по умолчанию зависят от модели.
number
Температура сэмплирования от 0 до 2. Более высокие значения дают более случайный результат. По умолчанию: 1.
boolean
Если true, ответ возвращается в виде потока событий, отправляемых сервером (SSE). По умолчанию: false.
number
Ядерное сэмплирование — рассматриваются только токены в верхней части вероятностной массы top_p. По умолчанию: 1.
string | array
Одна или несколько последовательностей, при достижении которых модель прекращает генерацию. Может быть строкой или массивом строк.
array
Список определений инструментов для вызова функций. Каждый инструмент должен иметь type: "function" и объект function с полями name, description и parameters.
string | object
Управляет выбором инструмента: "none", "auto", "required" или конкретный инструмент {"type": "function", "function": {"name": "..."}}.

Пример запроса

Ответ

Поля ответа

string
Уникальный идентификатор завершения.
array
Массив сгенерированных вариантов завершения.
object
Количество токенов для тарификации.

Потоковая передача

Установите stream: true, чтобы получать поток фрагментов SSE. Каждый фрагмент имеет ту же структуру, но содержит частичное содержимое delta вместо полного сообщения:
python