Kalkulator Biaya Token
Konversi gratis dan online jumlah token menjadi estimasi biaya API di 20+ model. Bandingkan OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, dan lainnya berdampingan. Modelkan penghematan cache prompt, tambahkan harga khusus, dan proyeksikan pengeluaran bulanan — semua di browser Anda, tanpa pendaftaran.
Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.
Token Counts
Workload Volume
Primary Model
Monthly Cost - GPT-4o
Cost / Call
$0.0225
Input Cost
$0.0125
Output Cost
$0.0100
Cache Savings
-
Daily
$22.50
1,000 calls
Monthly
$675.00
30,000 calls
Yearly
$8,212.50
365,000 calls
Full Provider Comparison
| Model | Cost / Call | Input Cost | Output Cost | Monthly Total | Features |
|---|---|---|---|---|---|
Mistral SmallMistralCost-Effective $0.1000/M in · $0.3000/M out | $0.000800 | $0.000500 | $0.000300 | $24.00 | - |
GPT-4o miniOpenAICost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | Caching |
Command RCohereCost-Effective $0.1500/M in · $0.6000/M out | $0.001350 | $0.000750 | $0.000600 | $40.50 | - |
Grok 3 MinixAICost-Effective $0.3000/M in · $0.5000/M out | $0.002000 | $0.001500 | $0.000500 | $60.00 | - |
DeepSeek-V3DeepSeekCost-Effective $0.2700/M in · $1.1000/M out | $0.002450 | $0.001350 | $0.001100 | $73.50 | Caching |
Gemini 2.5 FlashGoogleCost-Effective $0.3000/M in · $2.5000/M out | $0.004000 | $0.001500 | $0.002500 | $120.00 | Caching |
Llama 3.1 70BMetaCost-Effective $0.7200/M in · $0.7200/M out | $0.004320 | $0.003600 | $0.000720 | $129.60 | - |
DeepSeek-R1DeepSeek $0.5500/M in · $2.1900/M out | $0.004940 | $0.002750 | $0.002190 | $148.20 | Caching |
Claude 3.5 HaikuAnthropicCost-Effective $0.8000/M in · $4.0000/M out | $0.008000 | $0.004000 | $0.004000 | $240.00 | Caching |
o4-miniOpenAICost-Effective $1.1000/M in · $4.4000/M out | $0.009900 | $0.005500 | $0.004400 | $297.00 | Caching |
Gemini 1.5 ProGoogle $1.2500/M in · $5.0000/M out | $0.0112 | $0.006250 | $0.005000 | $337.50 | Caching |
Mistral LargeMistral $2.0000/M in · $6.0000/M out | $0.0160 | $0.0100 | $0.006000 | $480.00 | - |
Gemini 2.5 ProGoogle $1.2500/M in · $10.0000/M out | $0.0163 | $0.006250 | $0.0100 | $487.50 | Caching |
o3OpenAI $2.0000/M in · $8.0000/M out | $0.0180 | $0.0100 | $0.008000 | $540.00 | Caching |
GPT-4oOpenAI Primary $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | Caching |
Command R+Cohere $2.5000/M in · $10.0000/M out | $0.0225 | $0.0125 | $0.0100 | $675.00 | - |
Claude 3.7 SonnetAnthropicCapable $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | Caching |
Grok 3xAI $3.0000/M in · $15.0000/M out | $0.0300 | $0.0150 | $0.0150 | $900.00 | - |
Llama 3.1 405BMeta $5.0000/M in · $16.0000/M out | $0.0410 | $0.0250 | $0.0160 | $1,230.00 | - |
GPT-5.5OpenAICapable $5.0000/M in · $30.0000/M out | $0.0550 | $0.0250 | $0.0300 | $1,650.00 | Caching |
Claude 3 OpusAnthropicCapable $15.0000/M in · $75.0000/M out | $0.1500 | $0.0750 | $0.0750 | $4,500.00 | Caching |
Click any row to set it as the primary model. 21 models shown.
Mengonversi token ke biaya
Perhitungannya langsung: kalikan token input dengan tarifnya, token output dengan tarifnya, lalu jumlahkan. Kesulitannya ada pada pemilihan model dan mengetahui berapa token yang benar-benar dihasilkan beban Anda.
Token output 3 sampai 8 kali lebih mahal, jadi mengendalikan panjang jawaban biasanya memberi penghematan terbesar.
- Biaya = token input × tarif input + token output × tarif output.
- Tarif dinyatakan per juta token.
- Pilih satuan periode untuk melihat total yang relevan.
Cache prompt dan model khusus
Jika Anda memakai ulang prefiks besar yang stabil, cache menurunkan biayanya secara signifikan. Masukkan token cache untuk mengukur penghematan nyatanya.
- Cache: biasanya 10-25 % dari tarif input standar.
- Menguntungkan untuk system prompt, instruksi tetap, atau konteks bersama.
- Tambahkan harga khusus untuk membandingkan model privat atau fine-tuned.
Membandingkan penyedia dan memproyeksikan pengeluaran
Tujuannya menemukan model termurah yang memenuhi standar kualitas Anda, bukan yang termurah secara abstrak.
- Dapatkan jumlah token input dan output nyata per panggilan.
- Masukkan volume permintaan dan periode.
- Bandingkan model kandidat di tabel.
- Tinjau proyeksi bulanan dan tahunan sebelum menetapkan anggaran.
Pertanyaan yang Sering Diajukan
Alat ini mengonversi jumlah token menjadi estimasi biaya API di penyedia model bahasa. Anda memasukkan jumlah token input dan output — dari tokenizer, template prompt, atau metadata API Anda — dan alat ini langsung menghitung biaya per panggilan serta proyeksi pengeluaran bulanan atau tahunan. Berbeda dari penghitung token, yang mengestimasi token dari teks mentah.
Token input adalah prompt yang dikirim ke model; token output adalah jawaban yang dihasilkan. Token output lebih mahal secara komputasi dan dihargai jauh lebih tinggi — biasanya 3 sampai 8× harga input. Untuk sebagian besar beban, memangkas token output yang tak perlu lebih berdampak pada biaya daripada mengurangi token input.
Cache prompt menyimpan konten berulang di cache sementara. Permintaan berikutnya yang memakai prefiks sama ditagih jauh lebih murah (biasanya 10-25 % dari tarif input standar, artinya penghematan 75-90 %). Kalkulator memungkinkan memasukkan jumlah token cache Anda untuk memodelkan penghematan itu dengan akurat.
Kalkulator memuat 20+ model dari OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R), dan Meta (Llama 3.1 70B/405B).
Bisa. Buka bagian «Harga Model Khusus» untuk menambahkan model dengan tarif per juta token Anda sendiri. Model khusus muncul di tabel perbandingan bersama preset, memungkinkan Anda membandingkan model fine-tuned atau privat dengan penyedia API terkelola.
Semua tarif mencerminkan harga standar pay-as-you-go dari dokumentasi resmi tiap penyedia. Biaya nyata bisa berbeda karena pajak daerah, diskon volume, atau perjanjian perusahaan khusus. Selalu verifikasi di halaman harga resmi penyedia sebelum keputusan penagihan produksi.
Ya. Kalkulator berjalan 100 % di sisi klien di browser Anda. Jumlah token, volume permintaan, dan estimasi biaya dihitung lokal di perangkat Anda dan tidak pernah dikirim ke server mana pun. Tidak ada data yang keluar dari browser dan tidak perlu pendaftaran.