Skip to main content
El endpoint /v1/responses implementa la Responses API de OpenAI, que admite conversaciones multi-turno con estado y gestión integrada del historial de conversación. Es una alternativa a /v1/chat/completions para flujos de trabajo que requieren el formato de respuesta más reciente de OpenAI. Pasa un previous_response_id para continuar una conversación sin necesidad de reenviar el historial completo de mensajes.

Endpoint

Cuándo usar este endpoint

Usa /v1/responses si:
  • Tu aplicación está construida sobre la Responses API de OpenAI
  • Necesitas gestión de conversaciones con estado
  • Usas el parámetro previous_response_id para conversaciones multi-turno
Para la mayoría de las nuevas integraciones, /v1/chat/completions es el endpoint recomendado y tiene una compatibilidad más amplia con modelos.

Solicitud

Cabeceras

Parámetros del cuerpo

string
requerido
ID del modelo a utilizar. Aquí solo son válidos los modelos que admiten el formato de la Responses API.
string | array
requerido
La entrada del usuario para este turno. Puede ser una cadena de texto o un array de objetos de contenido.
string
Instrucciones a nivel de sistema para el modelo (equivalente al mensaje system en las completions de chat).
string
El id de una respuesta anterior. Cuando se proporciona, el modelo continúa la conversación desde ese punto sin que el cliente tenga que enviar el historial.
integer
Número máximo de tokens a generar.
boolean
Si es true, devuelve un flujo de eventos enviados por el servidor. Por defecto: false.

Ejemplo de solicitud

python

Multi-turno con previous_response_id

python

Respuesta

Campos de la respuesta

string
Identificador único de esta respuesta. Pásalo como previous_response_id para continuar la conversación.
string
Siempre "response".
integer
Marca de tiempo Unix de cuándo se creó la respuesta.
string
El modelo que generó la respuesta.
array
Array de objetos de salida producidos por el modelo.
object
Conteo de tokens para facturación.