Tagihan AI dihitung per token, bukan per request. Pahami rumusnya sekali, hematnya berkali-kali.
Rumus dasar
Setiap model punya dua tarif: input (prompt yang kamu kirim) dan output (jawaban model). Contoh Sonnet 4.6: $3 per 1 juta token input, $15 per 1 juta token output.
Estimasi kasar untuk pemakaian campuran (70% input, 30% output):
- Haiku: sekitar Rp35.000 per 1 juta token
- Sonnet: sekitar Rp105.000 per 1 juta token
- Opus: sekitar Rp176.000 per 1 juta token
(Kurs Rp16.000 per dolar.)
Artinya untuk paketmu
- Budget Rp20.000 (Lite) cukup untuk sekitar 570 ribu token Haiku, 190 ribu token Sonnet, atau 110 ribu token Opus.
- Budget Rp40.000 (Max) dua kali lipatnya.
- Angka kuota 15M/30M token di halaman paket adalah batas atas. Yang habis duluan selalu budget rupiah, dan dashboard [Billing](/member/billing) menampilkan sisanya secara real-time.
3 cara menghemat
- Batasi
max_tokens. Jangan minta 8.000 token kalau butuh 500. Output adalah komponen termahal. - Pakai model termurah yang cukup. Chat sederhana tidak butuh Opus.
- Pangkas konteks. Kirim riwayat percakapan seperlunya, karena setiap token input dihitung ulang tiap request.
Pantau halaman Usage tiap minggu. Kalau burn rate terlalu cepat di 7 hari pertama, turunkan model atau kecilkan max_tokens sebelum budget habis.