/v1/responses implementa la Responses API de OpenAI, que admite conversaciones multi-turno con estado y gestión integrada del historial de conversación. Es una alternativa a /v1/chat/completions para flujos de trabajo que requieren el formato de respuesta más reciente de OpenAI. Pasa un previous_response_id para continuar una conversación sin necesidad de reenviar el historial completo de mensajes.
Endpoint
Cuándo usar este endpoint
Usa/v1/responses si:
- Tu aplicación está construida sobre la Responses API de OpenAI
- Necesitas gestión de conversaciones con estado
- Usas el parámetro
previous_response_idpara conversaciones multi-turno
/v1/chat/completions es el endpoint recomendado y tiene una compatibilidad más amplia con modelos.
Solicitud
Cabeceras
Parámetros del cuerpo
string
requerido
ID del modelo a utilizar. Aquí solo son válidos los modelos que admiten el formato de la Responses API.
string | array
requerido
La entrada del usuario para este turno. Puede ser una cadena de texto o un array de objetos de contenido.
string
Instrucciones a nivel de sistema para el modelo (equivalente al mensaje
system en las completions de chat).string
El
id de una respuesta anterior. Cuando se proporciona, el modelo continúa la conversación desde ese punto sin que el cliente tenga que enviar el historial.integer
Número máximo de tokens a generar.
boolean
Si es
true, devuelve un flujo de eventos enviados por el servidor. Por defecto: false.Ejemplo de solicitud
python
Multi-turno con previous_response_id
python
Respuesta
Campos de la respuesta
string
Identificador único de esta respuesta. Pásalo como
previous_response_id para continuar la conversación.string
Siempre
"response".integer
Marca de tiempo Unix de cuándo se creó la respuesta.
string
El modelo que generó la respuesta.
array
Array de objetos de salida producidos por el modelo.
object
Conteo de tokens para facturación.