Lompat ke konten
Aback Tools Logo

Kalkulator Biaya Gemini

Estimasi gratis pengeluaran API Gemini berdasarkan pemakaian token Anda. Mendukung perbandingan model (Gemini 1.5, 2.5, 3.x), diskon cache konteks, dan proyeksi bulanan. Cepat, aman, dan sepenuhnya privat.

Gemini Cost Calculator

Estimate input/output token pricing, compare legacy and active model tiers, configure context caching discounts, and analyze overall monthly API forecasts locally.

Input/1M: $1.50Output/1M: $9.00Cache/1M: $0.38

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$495.00for 30,000 total requests

Cost per Single Call

$0.0165

Input Token Cost

$0.007500

Output Token Cost

$0.009000

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Gemini 1.5 Flash-8B (Legacy)
In: $0.04/M • Out: $0.15/M • Cache: $0.01/M
$0.000338$10.13Caching Supported
Gemini 1.5 Flash (Legacy)
In: $0.07/M • Out: $0.30/M • Cache: $0.02/M
$0.000675$20.25Caching Supported
Gemini 3.1 Flash-Lite
In: $0.25/M • Out: $1.50/M • Cache: $0.06/M
$0.002750$82.50Std. Caching
Gemini 2.5 Flash
In: $0.30/M • Out: $2.50/M • Cache: $0.07/M
$0.004000$120.00Std. Caching
Gemini 1.0 Pro (Legacy)
In: $0.50/M • Out: $1.50/M • Cache: $0.13/M
$0.004000$120.00Std. Caching
Gemini 3 Flash (Preview)
In: $0.50/M • Out: $3.00/M • Cache: $0.13/M
$0.005500$165.00Std. Caching
Gemini 1.5 Pro (Legacy)
In: $1.25/M • Out: $5.00/M • Cache: $0.31/M
$0.0112$337.50Caching Supported
Gemini 2.5 Pro
In: $1.25/M • Out: $10.00/M • Cache: $0.31/M
$0.0163$487.50Std. Caching
Gemini 3.5 FlashCost-Effective Selected
In: $1.50/M • Out: $9.00/M • Cache: $0.38/M
$0.0165$495.00Std. Caching
Gemini 3.1 Pro (Preview)Capable
In: $2.00/M • Out: $12.00/M • Cache: $0.50/M
$0.0220$660.00Std. Caching
Calculations Disclaimer: Estimations are computed based on standard per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by content text), Google Cloud tax schedules, or custom SLA pricing. Context Caching rates apply standardly at a 75% input tokens discount.

Apa yang membentuk tagihan Gemini

Di Gemini biaya bergantung pada model, rasio token input terhadap output, dan pada mode multimodal, seberapa banyak media yang Anda kirim dan dikonversi ke token ekuivalen.

Masukkan token teks, jumlah gambar, detik audio dan video, serta volume kueri untuk melihat biaya per kueri dan proyeksi bulanan.

  • Token output 3 sampai 8 kali lebih mahal daripada token input.
  • Gambar ditagih sekitar 258 token per gambar.
  • Setiap detik video setara sekitar 258 token, jadi klip panjang cepat mahal.

Cache konteks dan Batch API

Keduanya menurunkan harga, tetapi dengan syarat berbeda. Cache butuh konten yang berulang; Batch mengharuskan menoleransi latensi 24 jam.

  • Cache konteks: hingga 75 % lebih murah untuk token input yang dipakai ulang.
  • Batch API: diskon 50 % saat respons real-time tidak diperlukan.
  • Kombinasikan keduanya bila konteks panjang yang sama dipakai ulang dalam proses batch.

Membandingkan model keluarga Gemini

Keluarga ini mencakup dari volume tinggi berbiaya rendah hingga penalaran berkonteks sangat panjang. Pilihan model adalah tuas paling berpengaruh pada tagihan.

  1. Ukur token nyata pada satu kueri representatif, termasuk media.
  2. Hitung biaya per kueri dengan model yang Anda pakai sekarang.
  3. Bandingkan dengan varian Gemini lain pada beban kerja yang sama.
  4. Aktifkan cache atau Batch bila cocok dengan pola pemakaian dan tinjau proyeksi akhirnya.

Pertanyaan yang Sering Diajukan

Alat ini memperkirakan harga API Google Gemini berdasarkan jumlah token input dan output, volume kueri, serta konfigurasi model. Alat ini membantu developer merencanakan anggaran dan memilih model Gemini paling hemat untuk bebannya. Berjalan sepenuhnya di browser tanpa pendaftaran.

Kalkulator memakai tarif Pay-As-You-Go standar dari dokumentasi resmi Google AI Studio dan Vertex AI. Namun biaya nyata bisa berbeda karena kebijakan pajak regional, kredit promosi, paket harga khusus, atau pembaruan harga oleh Google. Selalu cek halaman harga resmi untuk tarif yang pasti.

Token input adalah teks atau media yang Anda kirim dalam prompt. Token output adalah teks jawaban yang dihasilkan model. Menghasilkannya lebih berat secara komputasi, jadi harganya jauh lebih tinggi (biasanya 3 sampai 8 kali) daripada token input di semua model Gemini.

Cache konteks memungkinkan menyimpan blok konten besar yang berulang (seperti basis kode panjang, buku, atau instruksi sistem panjang) di cache Google. Saat mengirim kueri, model membaca dari cache alih-alih memproses ulang seluruh prompt. Token input yang di-cache dikenai diskon besar (umumnya 75 % lebih murah dari token input standar).

Batch API dari Google dirancang untuk beban yang tidak sensitif latensi (terjemahan massal, pengindeksan offline, peringkasan). Alih-alih real-time, permintaan batch diproses di latar belakang dalam 24 jam. Menggunakannya memberi diskon otomatis 50 % untuk semua biaya token input dan output.

Gemini adalah model multimodal native dan menagih media dengan mengubahnya menjadi jumlah token ekuivalen. Teks ditokenisasi standar. Gambar biasanya ditagih 258 token per gambar. Audio ditagih 32 token per detik dan video 258 token per detik. Kalkulator ini memungkinkan memasukkan jumlah dan durasi media untuk mengestimasi biaya tersebut secara otomatis.

Tidak. Kalkulator berjalan sepenuhnya di sisi klien, di browser Anda. Input, ukuran token, perkiraan biaya, dan hasil perbandingan diproses lokal di perangkat Anda dan tidak pernah dikirim ke server mana pun. Data Anda tetap 100 % privat dan aman.