/v1/chat/completions generiert eine Textvervollständigung auf Basis einer Liste von Nachrichten. Er ist der primäre Endpunkt für Chat-, Instruction-Following- und Textgenerierungsaufgaben. Das Anfrageformat ist identisch mit der OpenAI Chat Completions API, sodass jedes OpenAI-kompatible SDK ohne Änderungen funktioniert.
Endpunkt
Anfrage
Header
Body-Parameter
string
erforderlich
Die zu verwendende Modell-ID. Alle gültigen Werte finden Sie im Modellverzeichnis. Beispiel:
"gpt-4o", "claude-sonnet-4-5", "gemini-2.5-flash".array
erforderlich
Ein Array von Nachrichtenobjekten, das die Konversation repräsentiert. Jedes Objekt muss
role ("system", "user" oder "assistant") und content (String) enthalten.integer
Maximale Anzahl der zu generierenden Token. Standardwerte variieren je nach Modell.
number
Sampling-Temperatur zwischen 0 und 2. Höhere Werte erzeugen zufälligere Ausgaben. Standard: 1.
boolean
Wenn
true, wird die Antwort als Stream von Server-Sent Events (SSE) zurückgegeben. Standard: false.number
Nucleus-Sampling — es werden nur Token aus der obersten
top_p-Wahrscheinlichkeitsmasse berücksichtigt. Standard: 1.string | array
Eine oder mehrere Sequenzen, bei denen das Modell die Generierung stoppt. Kann ein String oder ein Array von Strings sein.
array
Eine Liste von Tool-Definitionen für Function Calling. Jedes Tool muss
type: "function" und ein function-Objekt mit name, description und parameters enthalten.string | object
Steuert die Tool-Auswahl:
"none", "auto", "required" oder ein spezifisches Tool {"type": "function", "function": {"name": "..."}}.Beispielanfrage
Antwort
Antwortfelder
string
Eindeutiger Bezeichner für die Vervollständigung.
array
Array der generierten Vervollständigungs-Choices.
object
Token-Anzahl für die Abrechnung.
Streaming
Setzen Siestream: true, um einen Stream von SSE-Chunks zu empfangen. Jeder Chunk hat dieselbe Struktur, enthält jedoch partiellen delta-Inhalt anstelle einer vollständigen Nachricht:
python