Definisi 1 Prompt
Kuota Coding Plan dihitung berdasarkan prompt, bukan jumlah token. Satu prompt dihitung setara dengan satu giliran interaksi user (turn) di coding tool, terlepas dari berapa banyak sub-panggilan model yang dipicu oleh agent secara internal.Satu instruksi seperti “refactor modul autentikasi dan jalankan unit test” dapat memicu 15 hingga 20 panggilan model di balik layar (membaca file, iterasi reasoning, menjalankan command shell). Seluruh siklus interaksi tersebut tetap dihitung sebagai 1 prompt.
Jendela Kuota
Sistem menerapkan dua batasan waktu independen:- Tanpa Biaya Tambahan (Zero Overage): Saat kuota pada salah satu jendela habis, request akan dihentikan sementara (hard-stop) sampai siklus reset berikutnya.
- Isolasi Saldo Deposit: Kuota coding plan tidak pernah memotong saldo deposit Pay-As-You-Go akun Anda.
Perbandingan Tier Paket
Batas Konkurensi In-Flight
Batas request bersamaan (in-flight concurrency) membatasi berapa banyak proses agent yang dapat berjalan secara simultan pada saat yang sama. Jika batas konkurensi tercapai, request baru akan ditolak sementara hingga proses sebelumnya selesai.Multiplier Model Berbasis Beban
Setiap prompt yang dikirimkan menggunakan kuota sesuai dengan koefisien multiplier model yang digunakan. Model kategori flagship menyesuaikan multiplier ketika kapasitas upstream mengalami beban tinggi (under load):Status beban (under load) dideteksi secara dinamis secara real-time berdasarkan tingkat error kapasitas provider upstream, bukan berdasarkan jadwal jam tetap.
Tips Optimalisasi Kuota
- Gunakan Model Ringan untuk Tugas Rutin: Gunakan model cepat seperti
gemini-3-flashuntuk pencarian file atau penulisan fungsi sederhana (hanya 1× kuota). - Simpan Model Flagship untuk Refactoring Kompleks: Alokasikan model flagship untuk perancangan arsitektur multi-file dan debugging mendalam.
- Gabungkan Konteks Relevan: Satukan beberapa instruksi perbaikan kecil dalam satu giliran prompt untuk menghemat konsumsi kuota.