Skip to main content
Endpoint /v1/chat/completions menghasilkan penyelesaian teks berdasarkan daftar pesan. Ini adalah endpoint utama untuk obrolan, mengikuti instruksi, dan tugas pembuatan teks. Format permintaan identik dengan OpenAI Chat Completions API, sehingga SDK apa pun yang kompatibel dengan OpenAI dapat digunakan tanpa modifikasi.

Endpoint

Permintaan

Parameter body

string
wajib
ID model yang akan digunakan. Lihat Direktori Model untuk semua nilai yang valid. Contoh: "gpt-4o", "claude-sonnet-4-5", "gemini-2.5-flash".
array
wajib
Array objek pesan yang merepresentasikan percakapan. Setiap objek harus memiliki role ("system", "user", atau "assistant") dan content (string).
integer
Jumlah maksimum token yang akan dihasilkan. Nilai default bervariasi tergantung model.
number
Temperatur sampling antara 0 dan 2. Nilai yang lebih tinggi menghasilkan output yang lebih acak. Default: 1.
boolean
Jika true, respons dikembalikan sebagai aliran peristiwa yang dikirim server (SSE). Default: false.
number
Nucleus sampling — hanya token dalam massa probabilitas top_p teratas yang dipertimbangkan. Default: 1.
string | array
Satu atau lebih urutan di mana model berhenti menghasilkan. Dapat berupa string atau array string.
array
Daftar definisi alat untuk pemanggilan fungsi. Setiap alat harus memiliki type: "function" dan objek function dengan name, description, dan parameters.
string | object
Mengontrol pemilihan alat: "none", "auto", "required", atau alat tertentu {"type": "function", "function": {"name": "..."}}.

Contoh permintaan

Respons

Kolom respons

string
Pengenal unik untuk penyelesaian.
array
Array pilihan penyelesaian yang dihasilkan.
object
Jumlah token untuk penagihan.

Streaming

Atur stream: true untuk menerima aliran potongan SSE. Setiap potongan memiliki struktur yang sama tetapi dengan konten delta parsial alih-alih pesan lengkap:
python