/v1/chat/completions memungkinkan aplikasi Anda menampilkan token teks seketika saat dihasilkan oleh model AI, memangkas perceived latency untuk antarmuka chat dan CLI.
Format Event Stream
Setiap chunk dikirim sebagai event SSE dengan formatdata: <JSON>:
Melacak Penggunaan Token saat Streaming
Sertakan parameterstream_options untuk menerima total token yang digunakan pada chunk terakhir: