Kalkulator Biaya Gemini
Estimasi gratis pengeluaran API Gemini berdasarkan pemakaian token Anda. Mendukung perbandingan model (Gemini 1.5, 2.5, 3.x), diskon cache konteks, dan proyeksi bulanan. Cepat, aman, dan sepenuhnya privat.
Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0165
Input Token Cost
$0.007500
Output Token Cost
$0.009000
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Gemini 1.5 Flash-8B (Legacy) In: $0.04/M • Out: $0.15/M • Cache: $0.01/M | $0.000338 | $10.13 | Caching Supported |
Gemini 1.5 Flash (Legacy) In: $0.07/M • Out: $0.30/M • Cache: $0.02/M | $0.000675 | $20.25 | Caching Supported |
Gemini 3.1 Flash-Lite In: $0.25/M • Out: $1.50/M • Cache: $0.06/M | $0.002750 | $82.50 | Std. Caching |
Gemini 2.5 Flash In: $0.30/M • Out: $2.50/M • Cache: $0.07/M | $0.004000 | $120.00 | Std. Caching |
Gemini 1.0 Pro (Legacy) In: $0.50/M • Out: $1.50/M • Cache: $0.13/M | $0.004000 | $120.00 | Std. Caching |
Gemini 3 Flash (Preview) In: $0.50/M • Out: $3.00/M • Cache: $0.13/M | $0.005500 | $165.00 | Std. Caching |
Gemini 1.5 Pro (Legacy) In: $1.25/M • Out: $5.00/M • Cache: $0.31/M | $0.0112 | $337.50 | Caching Supported |
Gemini 2.5 Pro In: $1.25/M • Out: $10.00/M • Cache: $0.31/M | $0.0163 | $487.50 | Std. Caching |
Gemini 3.5 FlashCost-Effective Selected In: $1.50/M • Out: $9.00/M • Cache: $0.38/M | $0.0165 | $495.00 | Std. Caching |
Gemini 3.1 Pro (Preview)Capable In: $2.00/M • Out: $12.00/M • Cache: $0.50/M | $0.0220 | $660.00 | Std. Caching |
Apa yang membentuk tagihan Gemini
Di Gemini biaya bergantung pada model, rasio token input terhadap output, dan pada mode multimodal, seberapa banyak media yang Anda kirim dan dikonversi ke token ekuivalen.
Masukkan token teks, jumlah gambar, detik audio dan video, serta volume kueri untuk melihat biaya per kueri dan proyeksi bulanan.
- Token output 3 sampai 8 kali lebih mahal daripada token input.
- Gambar ditagih sekitar 258 token per gambar.
- Setiap detik video setara sekitar 258 token, jadi klip panjang cepat mahal.
Cache konteks dan Batch API
Keduanya menurunkan harga, tetapi dengan syarat berbeda. Cache butuh konten yang berulang; Batch mengharuskan menoleransi latensi 24 jam.
- Cache konteks: hingga 75 % lebih murah untuk token input yang dipakai ulang.
- Batch API: diskon 50 % saat respons real-time tidak diperlukan.
- Kombinasikan keduanya bila konteks panjang yang sama dipakai ulang dalam proses batch.
Membandingkan model keluarga Gemini
Keluarga ini mencakup dari volume tinggi berbiaya rendah hingga penalaran berkonteks sangat panjang. Pilihan model adalah tuas paling berpengaruh pada tagihan.
- Ukur token nyata pada satu kueri representatif, termasuk media.
- Hitung biaya per kueri dengan model yang Anda pakai sekarang.
- Bandingkan dengan varian Gemini lain pada beban kerja yang sama.
- Aktifkan cache atau Batch bila cocok dengan pola pemakaian dan tinjau proyeksi akhirnya.
Pertanyaan yang Sering Diajukan
Alat ini memperkirakan harga API Google Gemini berdasarkan jumlah token input dan output, volume kueri, serta konfigurasi model. Alat ini membantu developer merencanakan anggaran dan memilih model Gemini paling hemat untuk bebannya. Berjalan sepenuhnya di browser tanpa pendaftaran.
Kalkulator memakai tarif Pay-As-You-Go standar dari dokumentasi resmi Google AI Studio dan Vertex AI. Namun biaya nyata bisa berbeda karena kebijakan pajak regional, kredit promosi, paket harga khusus, atau pembaruan harga oleh Google. Selalu cek halaman harga resmi untuk tarif yang pasti.
Token input adalah teks atau media yang Anda kirim dalam prompt. Token output adalah teks jawaban yang dihasilkan model. Menghasilkannya lebih berat secara komputasi, jadi harganya jauh lebih tinggi (biasanya 3 sampai 8 kali) daripada token input di semua model Gemini.
Cache konteks memungkinkan menyimpan blok konten besar yang berulang (seperti basis kode panjang, buku, atau instruksi sistem panjang) di cache Google. Saat mengirim kueri, model membaca dari cache alih-alih memproses ulang seluruh prompt. Token input yang di-cache dikenai diskon besar (umumnya 75 % lebih murah dari token input standar).
Batch API dari Google dirancang untuk beban yang tidak sensitif latensi (terjemahan massal, pengindeksan offline, peringkasan). Alih-alih real-time, permintaan batch diproses di latar belakang dalam 24 jam. Menggunakannya memberi diskon otomatis 50 % untuk semua biaya token input dan output.
Gemini adalah model multimodal native dan menagih media dengan mengubahnya menjadi jumlah token ekuivalen. Teks ditokenisasi standar. Gambar biasanya ditagih 258 token per gambar. Audio ditagih 32 token per detik dan video 258 token per detik. Kalkulator ini memungkinkan memasukkan jumlah dan durasi media untuk mengestimasi biaya tersebut secara otomatis.
Tidak. Kalkulator berjalan sepenuhnya di sisi klien, di browser Anda. Input, ukuran token, perkiraan biaya, dan hasil perbandingan diproses lokal di perangkat Anda dan tidak pernah dikirim ke server mana pun. Data Anda tetap 100 % privat dan aman.