/v1/chat/completions генерирует текстовое завершение на основе списка сообщений. Это основной эндпоинт для задач чата, следования инструкциям и генерации текста. Формат запроса идентичен OpenAI Chat Completions API, поэтому любой совместимый с OpenAI SDK работает без изменений.
Эндпоинт
Запрос
Заголовки
Параметры тела запроса
string
обязательно
Идентификатор модели для использования. Все допустимые значения см. в каталоге моделей. Пример:
"gpt-4o", "claude-sonnet-4-5", "gemini-2.5-flash".array
обязательно
Массив объектов сообщений, представляющих беседу. Каждый объект должен иметь
role ("system", "user" или "assistant") и content (строка).integer
Максимальное количество токенов для генерации. Значения по умолчанию зависят от модели.
number
Температура сэмплирования от 0 до 2. Более высокие значения дают более случайный результат. По умолчанию: 1.
boolean
Если
true, ответ возвращается в виде потока событий, отправляемых сервером (SSE). По умолчанию: false.number
Ядерное сэмплирование — рассматриваются только токены в верхней части вероятностной массы
top_p. По умолчанию: 1.string | array
Одна или несколько последовательностей, при достижении которых модель прекращает генерацию. Может быть строкой или массивом строк.
array
Список определений инструментов для вызова функций. Каждый инструмент должен иметь
type: "function" и объект function с полями name, description и parameters.string | object
Управляет выбором инструмента:
"none", "auto", "required" или конкретный инструмент {"type": "function", "function": {"name": "..."}}.Пример запроса
Ответ
Поля ответа
string
Уникальный идентификатор завершения.
array
Массив сгенерированных вариантов завершения.
object
Количество токенов для тарификации.
Потоковая передача
Установитеstream: true, чтобы получать поток фрагментов SSE. Каждый фрагмент имеет ту же структуру, но содержит частичное содержимое delta вместо полного сообщения:
python