Cara menghitung biaya token AI sebenarnya tidak serumit yang dibayangkan. Pengguna hanya perlu mengetahui jumlah token yang diproses, harga token input, harga token output, dan kurs mata uang apabila tarif layanan ditampilkan dalam dolar Amerika Serikat.
Perhitungan ini terutama berlaku untuk penggunaan model AI melalui API. Biaya langganan aplikasi chatbot bulanan biasanya menggunakan mekanisme berbeda dan tidak selalu dihitung langsung berdasarkan jumlah token yang terlihat oleh pengguna.
Apa yang Dimaksud dengan Token AI?
Token adalah potongan teks yang dibaca dan dihasilkan oleh model AI. Satu token tidak selalu sama dengan satu kata. Sebuah kata dapat terdiri dari satu token atau beberapa token, tergantung pada bahasa, tanda baca, angka, dan metode pemecahan teks yang digunakan setiap model.
Karena itu, menghitung jumlah kata saja tidak cukup untuk mengetahui biaya secara tepat. Jumlah token sebenarnya biasanya dapat dilihat melalui laporan penggunaan API, alat penghitung token, atau data yang dikembalikan setelah permintaan selesai diproses.
Dalam penggunaan model AI berbasis teks, token umumnya dibagi menjadi token input dan token output. Sebagian penyedia juga mempunyai kategori token tersimpan dalam cache serta token khusus untuk proses tertentu.
Perbedaan Token Input dan Token Output
Token input
Token input adalah seluruh informasi yang dikirimkan kepada model. Bagian ini dapat mencakup pertanyaan pengguna, instruksi sistem, riwayat percakapan, isi dokumen, hasil pencarian, dan data lain yang disertakan dalam permintaan.
Jika sebuah aplikasi selalu mengirimkan kembali seluruh riwayat percakapan, jumlah token input dapat bertambah setiap kali pengguna melanjutkan percakapan.
Token output
Token output adalah teks yang dihasilkan oleh model sebagai jawaban. Respons yang lebih panjang biasanya menggunakan lebih banyak token output. Pada banyak layanan API, harga token output lebih tinggi daripada token input.
Oleh sebab itu, biaya tidak boleh dihitung dengan menggabungkan seluruh token lalu mengalikannya dengan satu harga. Token input dan output perlu dihitung menggunakan tarif masing-masing.
Rumus Dasar Menghitung Biaya Token AI
Harga API AI umumnya ditampilkan dalam biaya per satu juta token. Rumus sederhananya adalah sebagai berikut:
Biaya input = jumlah token input ÷ 1.000.000 × harga input per satu juta token
Biaya output = jumlah token output ÷ 1.000.000 × harga output per satu juta token
Total biaya = biaya input + biaya output
Apabila penyedia menggunakan satuan seribu token, angka pembaginya tinggal diubah dari 1.000.000 menjadi 1.000. Pastikan satuan harga diperiksa sebelum melakukan perhitungan.
Contoh Perhitungan Biaya Satu Permintaan
Anggap sebuah model memiliki tarif simulasi sebagai berikut. Angka ini hanya digunakan untuk menjelaskan cara menghitung dan bukan harga model tertentu:
- Token input sebesar 2 dolar AS per satu juta token
- Token output sebesar 8 dolar AS per satu juta token
Dalam satu permintaan, aplikasi menggunakan 12.000 token input dan menghasilkan 3.000 token output.
Menghitung biaya input
12.000 ÷ 1.000.000 × 2 dolar AS = 0,024 dolar AS.
Menghitung biaya output
3.000 ÷ 1.000.000 × 8 dolar AS = 0,024 dolar AS.
Menghitung total biaya
0,024 dolar AS + 0,024 dolar AS = 0,048 dolar AS.
Jika menggunakan asumsi kurs Rp16.000 untuk satu dolar AS, perhitungannya menjadi:
0,048 × Rp16.000 = Rp768.
Dengan demikian, biaya simulasi untuk satu permintaan tersebut adalah sekitar Rp768. Nilai dalam rupiah dapat berubah mengikuti kurs, pajak, metode pembayaran, serta kebijakan penyedia layanan.
Cara Memperkirakan Biaya AI per Bulan
Untuk membuat anggaran bulanan, hitung biaya rata-rata satu permintaan kemudian kalikan dengan jumlah permintaan. Sebagai contoh, sebuah aplikasi diperkirakan menerima 10.000 permintaan setiap bulan.
Setiap permintaan rata-rata menggunakan 1.500 token input dan 500 token output. Tarif simulasi tetap menggunakan 2 dolar AS untuk input dan 8 dolar AS untuk output per satu juta token.
Biaya input setiap permintaan:
1.500 ÷ 1.000.000 × 2 dolar AS = 0,003 dolar AS.
Biaya output setiap permintaan:
500 ÷ 1.000.000 × 8 dolar AS = 0,004 dolar AS.
Total setiap permintaan adalah 0,007 dolar AS. Apabila terdapat 10.000 permintaan, perkiraan biaya bulanannya menjadi:
0,007 × 10.000 = 70 dolar AS.
Dengan asumsi kurs Rp16.000 per dolar AS, perkiraannya mencapai Rp1.120.000 per bulan. Perhitungan ini belum memasukkan pajak atau biaya fitur tambahan.
Apa Itu Cached Token?
Cached token adalah bagian input berulang yang dapat digunakan kembali melalui mekanisme cache dari penyedia AI. Contohnya adalah instruksi sistem atau dokumen panjang yang sama dan dikirimkan berulang kali.
Beberapa penyedia memberikan tarif lebih rendah untuk pembacaan token yang sudah tersimpan dalam cache. Ada pula yang menetapkan biaya tersendiri ketika data pertama kali ditulis ke cache. Ketentuan dan masa berlaku cache berbeda pada setiap platform.
Jika laporan penggunaan memisahkan input biasa, penulisan cache, dan pembacaan cache, setiap kategori harus dihitung menggunakan tarifnya sendiri. Rumus totalnya menjadi:
Total biaya = input biasa + input cache + output + biaya layanan tambahan
Komponen Biaya yang Tidak Selalu Termasuk Token
Tagihan API AI tidak selalu berasal dari pemrosesan teks. Fitur tertentu dapat mempunyai satuan harga yang berbeda, antara lain:
- Pencarian web atau pemanggilan alat
- Pembuatan dan pengeditan gambar
- Pembuatan video
- Transkripsi serta pembuatan suara
- Penyimpanan dokumen dan basis data vektor
- Pemrosesan gambar, audio, atau video sebagai input
- Penggunaan komputer virtual atau eksekusi kode
- Pajak dan biaya transaksi pembayaran
Karena itu, mengalikan total token dengan tarif model belum tentu menghasilkan nilai tagihan akhir jika aplikasi juga menggunakan fitur tambahan.
Mengapa Tagihan Bisa Lebih Besar dari Perkiraan?
Salah satu penyebabnya adalah aplikasi mengirimkan riwayat percakapan secara berulang. Percakapan yang semakin panjang membuat input pada permintaan berikutnya ikut membesar.
Dokumen, instruksi sistem, contoh jawaban, dan hasil dari alat eksternal juga dapat masuk ke dalam konteks model. Meskipun bagian tersebut tidak selalu terlihat pada tampilan pengguna, tokennya tetap dapat diperhitungkan oleh penyedia API.
Penyebab lainnya adalah kegagalan aplikasi yang mengirim ulang permintaan, respons terlalu panjang, penggunaan model yang lebih mahal, atau fitur tambahan yang mempunyai tarif tersendiri.
Cara Mengontrol Biaya Penggunaan AI
Pengguna dapat menetapkan batas panjang output agar model tidak menghasilkan jawaban lebih panjang dari yang diperlukan. Riwayat percakapan juga dapat diringkas atau dipotong ketika tidak lagi relevan.
Untuk tugas sederhana, pertimbangkan model yang lebih ekonomis apabila kualitasnya sudah memenuhi kebutuhan. Pemantauan penggunaan sebaiknya dilakukan berdasarkan pengguna, fitur, model, serta jumlah permintaan agar sumber kenaikan biaya mudah ditemukan.
Gunakan data token sebenarnya dari respons API untuk pencatatan biaya. Perkiraan berdasarkan jumlah kata berguna untuk membuat anggaran awal, tetapi tidak seakurat laporan penggunaan dari penyedia model.
Tarif model AI dapat berubah. Sebelum menghitung anggaran produksi, periksa halaman harga resmi dan pastikan apakah tarif dinyatakan per seribu atau satu juta token. Perhatikan pula perbedaan harga input, output, cache, dan fitur tambahan.
Format Perhitungan yang Bisa Digunakan
Untuk menghitung biaya secara manual di spreadsheet, siapkan kolom jumlah token input, harga input, jumlah token output, harga output, dan kurs dolar. Gunakan perhitungan berikut:
((token input ÷ 1.000.000) × tarif input) + ((token output ÷ 1.000.000) × tarif output)
Hasil dalam dolar kemudian dikalikan dengan kurs yang digunakan. Untuk penggunaan dalam jumlah besar, tambahkan kolom jumlah permintaan, biaya alat tambahan, pajak, dan cadangan anggaran agar perkiraan lebih mendekati tagihan sebenarnya.