Buat chat
Meminta respons model untuk percakapan chat yang diberikan. Mendukung mode streaming maupun non-streaming, dengan satu bentuk permintaan/respons kompatibel OpenAI di semua model dan penyedia.
/api/v1/chat/completionsOtorisasi
AuthorizationwajibAPI key sebagai bearer token di header Authorization.
Body
modelwajibModel yang digunakan, dengan prefiks penyedia, mis. "openai/gpt-4.1". Id singkat dari keluarga model umum (mis. "gpt-4o") secara otomatis diresolusi ke id canonical lengkap ("openai/gpt-4o"); nilai yang sudah berbentuk canonical diteruskan apa adanya. Id singkat yang tidak dikenali tidak ditulis ulang paksa — resolusi model akan mengembalikan error model-not-found yang jelas.
"openai/gpt-4.1"messageswajibArray pesan percakapan, minimal satu. Setiap pesan memiliki role (system/user/assistant/tool) dan content.
modelsDaftar model fallback — dicoba berurutan, hanya digunakan setelah grup kandidat model utama habis.
streamtrue untuk streaming respons sebagai SSE; dihilangkan atau false mengembalikan satu respons JSON.
temperatureSuhu sampling — semakin tinggi semakin acak, semakin rendah semakin deterministik.
max_tokensJumlah token maksimum yang dapat dihasilkan respons.
max_completion_tokensAlias dari max_tokens dengan semantik identik.
top_pAmbang batas nucleus sampling.
top_kMembatasi sampling pada K token dengan probabilitas tertinggi.
frequency_penaltyMemberi penalti pada token berdasarkan seberapa sering sudah muncul.
presence_penaltyMemberi penalti pada token berdasarkan apakah sudah pernah muncul, tanpa memandang jumlahnya.
repetition_penaltyKoefisien penalti pengulangan — mekanisme terpisah dari frequency/presence penalty.
min_pAmbang probabilitas minimum relatif terhadap token paling mungkin.
top_aMekanisme sampling cutoff dinamis lainnya, menskalakan ambang dengan kuadrat probabilitas tertinggi.
seedSeed sampling deterministik; tidak semua penyedia menjamin reproduktifitas.
nJumlah respons yang dihasilkan.
stopUrutan yang menghentikan generasi, maksimal 4.
toolsDaftar definisi tool/fungsi yang dapat dipanggil model.
tool_choiceMengontrol apakah/bagaimana model dipaksa memanggil tool.
parallel_tool_callsApakah mengizinkan pemanggilan tool paralel saat tools disediakan. Default true. Hanya model keluarga OpenAI — dihapus secara diam-diam saat model target bukan milik OpenAI, bukan error.
response_formatMembatasi format output, mis. {type:"json_object"} atau {type:"json_schema"} dengan JSON Schema.
logit_biasMemetakan ID token ke nilai bias [-100, 100] yang ditambahkan sebelum sampling. Hanya model keluarga OpenAI — dihapus secara diam-diam saat model target bukan milik OpenAI, bukan error.
logprobsMengembalikan probabilitas log dari setiap token output. Hanya model keluarga OpenAI — dihapus secara diam-diam saat model target bukan milik OpenAI, bukan error.
top_logprobsJumlah token paling mungkin yang dikembalikan per posisi (memerlukan logprobs: true). Hanya model keluarga OpenAI — dihapus secara diam-diam saat model target bukan milik OpenAI, bukan error.
userPengidentifikasi pengguna akhir untuk pemantauan dan deteksi penyalahgunaan. Tidak berpengaruh pada tagihan. Hanya model keluarga OpenAI — dihapus secara diam-diam saat model target bukan milik OpenAI, bukan error.
reasoningObjek kontrol pemikiran model reasoning (mis. {effort, max_tokens}).
reasoning_effortField singkat datar untuk reasoning.effort.
lowmediumhighimage_configOpsi generasi/edit gambar (digunakan saat modalities menyertakan image).
modalitiesModalitas output yang diminta. Menyertakan image mengarahkan melalui jalur dispatch pembuatan gambar.
textimagepluginsArray plugin (mis. {id:"web"} untuk mengaktifkan pencarian web). Hanya didukung pada beberapa rute model, tanpa efek di tempat lain; varian model :online otomatis menyisipkan {id:"web"}, juga hanya pada rute yang mendukung.