Lompat ke konten
Aback Tools Logo

Kalkulator Biaya Token

Konversi gratis dan online jumlah token menjadi estimasi biaya API di 20+ model. Bandingkan OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, dan lainnya berdampingan. Modelkan penghematan cache prompt, tambahkan harga khusus, dan proyeksikan pengeluaran bulanan — semua di browser Anda, tanpa pendaftaran.

Token Cost Calculator

Enter your input and output token counts to instantly calculate API costs across 20+ models from OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral, Cohere, and Meta. Compare providers side-by-side, add custom pricing, and forecast monthly or annual spending.

Token Counts

tokens
tokens

Workload Volume

reqs

Primary Model

Monthly Cost - GPT-4o

$675.00for 30,000 calls

Cost / Call

$0.0225

Input Cost

$0.0125

Output Cost

$0.0100

Cache Savings

-

In rate: $2.5000/M tokensOut rate: $10.0000/M tokensCache rate: $1.2500/M tokens

Daily

$22.50

1,000 calls

Monthly

$675.00

30,000 calls

Yearly

$8,212.50

365,000 calls

Full Provider Comparison

ModelCost / CallInput CostOutput CostMonthly TotalFeatures
Mistral SmallMistralCost-Effective
$0.1000/M in · $0.3000/M out
$0.000800$0.000500$0.000300$24.00-
GPT-4o miniOpenAICost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50Caching
Command RCohereCost-Effective
$0.1500/M in · $0.6000/M out
$0.001350$0.000750$0.000600$40.50-
Grok 3 MinixAICost-Effective
$0.3000/M in · $0.5000/M out
$0.002000$0.001500$0.000500$60.00-
DeepSeek-V3DeepSeekCost-Effective
$0.2700/M in · $1.1000/M out
$0.002450$0.001350$0.001100$73.50Caching
Gemini 2.5 FlashGoogleCost-Effective
$0.3000/M in · $2.5000/M out
$0.004000$0.001500$0.002500$120.00Caching
Llama 3.1 70BMetaCost-Effective
$0.7200/M in · $0.7200/M out
$0.004320$0.003600$0.000720$129.60-
DeepSeek-R1DeepSeek
$0.5500/M in · $2.1900/M out
$0.004940$0.002750$0.002190$148.20Caching
Claude 3.5 HaikuAnthropicCost-Effective
$0.8000/M in · $4.0000/M out
$0.008000$0.004000$0.004000$240.00Caching
o4-miniOpenAICost-Effective
$1.1000/M in · $4.4000/M out
$0.009900$0.005500$0.004400$297.00Caching
Gemini 1.5 ProGoogle
$1.2500/M in · $5.0000/M out
$0.0112$0.006250$0.005000$337.50Caching
Mistral LargeMistral
$2.0000/M in · $6.0000/M out
$0.0160$0.0100$0.006000$480.00-
Gemini 2.5 ProGoogle
$1.2500/M in · $10.0000/M out
$0.0163$0.006250$0.0100$487.50Caching
o3OpenAI
$2.0000/M in · $8.0000/M out
$0.0180$0.0100$0.008000$540.00Caching
GPT-4oOpenAI Primary
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00Caching
Command R+Cohere
$2.5000/M in · $10.0000/M out
$0.0225$0.0125$0.0100$675.00-
Claude 3.7 SonnetAnthropicCapable
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00Caching
Grok 3xAI
$3.0000/M in · $15.0000/M out
$0.0300$0.0150$0.0150$900.00-
Llama 3.1 405BMeta
$5.0000/M in · $16.0000/M out
$0.0410$0.0250$0.0160$1,230.00-
GPT-5.5OpenAICapable
$5.0000/M in · $30.0000/M out
$0.0550$0.0250$0.0300$1,650.00Caching
Claude 3 OpusAnthropicCapable
$15.0000/M in · $75.0000/M out
$0.1500$0.0750$0.0750$4,500.00Caching

Click any row to set it as the primary model. 21 models shown.

Pricing Disclaimer: Rates reflect standard Pay-As-You-Go pricing from each provider's published documentation. Actual costs may vary due to regional taxes, volume discounts, promotional credits, or custom enterprise agreements. Cached token rates apply to supported models only. All calculations run locally in your browser - no data is sent to any server.

Mengonversi token ke biaya

Perhitungannya langsung: kalikan token input dengan tarifnya, token output dengan tarifnya, lalu jumlahkan. Kesulitannya ada pada pemilihan model dan mengetahui berapa token yang benar-benar dihasilkan beban Anda.

Token output 3 sampai 8 kali lebih mahal, jadi mengendalikan panjang jawaban biasanya memberi penghematan terbesar.

  • Biaya = token input × tarif input + token output × tarif output.
  • Tarif dinyatakan per juta token.
  • Pilih satuan periode untuk melihat total yang relevan.

Cache prompt dan model khusus

Jika Anda memakai ulang prefiks besar yang stabil, cache menurunkan biayanya secara signifikan. Masukkan token cache untuk mengukur penghematan nyatanya.

  • Cache: biasanya 10-25 % dari tarif input standar.
  • Menguntungkan untuk system prompt, instruksi tetap, atau konteks bersama.
  • Tambahkan harga khusus untuk membandingkan model privat atau fine-tuned.

Membandingkan penyedia dan memproyeksikan pengeluaran

Tujuannya menemukan model termurah yang memenuhi standar kualitas Anda, bukan yang termurah secara abstrak.

  1. Dapatkan jumlah token input dan output nyata per panggilan.
  2. Masukkan volume permintaan dan periode.
  3. Bandingkan model kandidat di tabel.
  4. Tinjau proyeksi bulanan dan tahunan sebelum menetapkan anggaran.

Pertanyaan yang Sering Diajukan

Alat ini mengonversi jumlah token menjadi estimasi biaya API di penyedia model bahasa. Anda memasukkan jumlah token input dan output — dari tokenizer, template prompt, atau metadata API Anda — dan alat ini langsung menghitung biaya per panggilan serta proyeksi pengeluaran bulanan atau tahunan. Berbeda dari penghitung token, yang mengestimasi token dari teks mentah.

Token input adalah prompt yang dikirim ke model; token output adalah jawaban yang dihasilkan. Token output lebih mahal secara komputasi dan dihargai jauh lebih tinggi — biasanya 3 sampai 8× harga input. Untuk sebagian besar beban, memangkas token output yang tak perlu lebih berdampak pada biaya daripada mengurangi token input.

Cache prompt menyimpan konten berulang di cache sementara. Permintaan berikutnya yang memakai prefiks sama ditagih jauh lebih murah (biasanya 10-25 % dari tarif input standar, artinya penghematan 75-90 %). Kalkulator memungkinkan memasukkan jumlah token cache Anda untuk memodelkan penghematan itu dengan akurat.

Kalkulator memuat 20+ model dari OpenAI (GPT-5.5, GPT-4o, o3, o4-mini), Anthropic (Claude 3.7 Sonnet, Claude 3.5 Haiku, Claude 3 Opus), Google (Gemini 2.5 Pro/Flash, Gemini 1.5 Pro), xAI (Grok 3, Grok 3 Mini), DeepSeek (V3, R1), Mistral (Large, Small), Cohere (Command R+/R), dan Meta (Llama 3.1 70B/405B).

Bisa. Buka bagian «Harga Model Khusus» untuk menambahkan model dengan tarif per juta token Anda sendiri. Model khusus muncul di tabel perbandingan bersama preset, memungkinkan Anda membandingkan model fine-tuned atau privat dengan penyedia API terkelola.

Semua tarif mencerminkan harga standar pay-as-you-go dari dokumentasi resmi tiap penyedia. Biaya nyata bisa berbeda karena pajak daerah, diskon volume, atau perjanjian perusahaan khusus. Selalu verifikasi di halaman harga resmi penyedia sebelum keputusan penagihan produksi.

Ya. Kalkulator berjalan 100 % di sisi klien di browser Anda. Jumlah token, volume permintaan, dan estimasi biaya dihitung lokal di perangkat Anda dan tidak pernah dikirim ke server mana pun. Tidak ada data yang keluar dari browser dan tidak perlu pendaftaran.