Lompat ke konten
Aback Tools Logo

Kalkulator Biaya Claude

Estimasi biaya API Anthropic Claude Anda secara gratis online. Mendukung pilihan model, estimasi token, cache prompt, diskon Batch API, dan proyeksi bulanan/tahunan. Bandingkan biaya berdampingan antar semua model Claude (termasuk Claude 3.5, Opus, Sonnet, Haiku, dan tingkat generasi baru Claude 5) untuk menemukan keseimbangan terbaik antara kecepatan, kemampuan, dan anggaran. Tanpa pendaftaran — perhitungan berjalan lokal di browser Anda.

Claude Cost Calculator

Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.

Input/1M: $3.00Output/1M: $15.00Cache/1M: $0.30

Prompt Tokens

tokens
tokens

Cost Optimizations

Workload Call Volume

reqs

Projected Monthly Workload Cost

$900.00for 30,000 total requests

Cost per Single Call

$0.0300

Input Token Cost

$0.0150

Output Token Cost

$0.0150

Model Pricing Comparisons

Sorted by lowest cost
Model NameCost/CallMonthly ForecastOptimization Match
Claude 3 Haiku
In: $0.25/M • Out: $1.25/M • Cache: $0.03/M
$0.002500$75.00Caching Supported
Claude Haiku 4.5Cost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude 3.5 HaikuCost-Effective
In: $1.00/M • Out: $5.00/M • Cache: $0.10/M
$0.0100$300.00Caching Supported
Claude Sonnet 4.6Capable
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3.5 SonnetCapable Selected
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude 3 Sonnet
In: $3.00/M • Out: $15.00/M • Cache: $0.30/M
$0.0300$900.00Caching Supported
Claude Opus 4.8Capable
In: $5.00/M • Out: $25.00/M • Cache: $0.50/M
$0.0500$1,500.00Caching Supported
Claude Fable 5Capable
In: $10.00/M • Out: $50.00/M • Cache: $1.00/M
$0.1000$3,000.00Caching Supported
Claude 3 Opus
In: $15.00/M • Out: $75.00/M • Cache: $1.50/M
$0.1500$4,500.00Caching Supported
Calculations Disclaimer: Estimations are computed based on standard Anthropic Claude per-token pricing sheets. Real-world API expenses may deviate slightly due to tokenization rounding differences (Word count to Token conversion ratio varies by text content), regional tax schedules, or custom SLA pricing. Context caching read rates apply standardly at a 90% input read discount.

Memahami struktur biaya Claude

Biaya Claude bergantung pada tiga variabel: model yang dipilih, rasio token input terhadap output, dan volume kueri. Token output biasanya 3 sampai 5 kali lebih mahal daripada token input, sehingga panjang jawaban menentukan tagihan.

Masukkan token input dan output per kueri, volume bulanan, dan model untuk melihat proyeksi dan membandingkan opsi.

  • Token output mendominasi biaya per kueri: mengendalikan panjang jawaban adalah tuas paling efektif.
  • Cache prompt dapat memangkas hingga 90 % biaya token input yang dipakai ulang.
  • Batch API memberi diskon tetap 50 % saat jawaban real-time tidak diperlukan.

Kapan masing-masing penghematan layak

Cache dan Batch tidak selalu membantu. Cache butuh prompt panjang yang berulang; Batch mengharuskan Anda menoleransi latensi 24 jam.

  • Cache: berguna untuk prompt sistem panjang dan stabil yang berulang di setiap kueri.
  • Batch: berguna untuk pemrosesan massal, evaluasi, dan tugas yang bisa menunggu.
  • Keduanya tidak menurunkan biaya satu prompt pendek sekali pakai.

Menyusun anggaran dengan margin aman

Estimasi hanya sebaik asumsi token Anda. Ukur sampel nyata sebelum mengekstrapolasi ke seluruh volume.

  1. Ukur token input dan output nyata pada sampel kueri yang representatif.
  2. Masukkan volume bulanan yang diperkirakan dan pilih modelnya.
  3. Aktifkan cache atau Batch bila pola pemakaian Anda cocok, lalu bandingkan skenario teroptimasi.
  4. Tambahkan margin 20-30 % untuk variasi panjang dan pertumbuhan pemakaian.

Pertanyaan yang Sering Diajukan

Ini alat untuk memperkirakan biaya penggunaan API Anthropic Claude. Dengan memasukkan token input/prompt, token output/penyelesaian, volume kueri, dan memilih model tertentu, developer dan founder SaaS bisa memproyeksikan pengeluaran bulanan/tahunan serta membandingkan biaya antar model.

Cache prompt sangat menurunkan biaya (hingga 90 %) untuk token input yang Anda pakai ulang di beberapa kueri. Saat diaktifkan, hanya token yang tidak di-cache yang ditagih dengan tarif standar; token yang di-cache ditagih dengan tarif baca yang jauh lebih rendah. Misalnya, pada Claude 3.5 Sonnet, pembacaan cache berbiaya $0,30/juta token dibanding $3,00/juta pada tarif standar.

Cache prompt memerlukan panjang prompt minimal 10.000 token pada Claude 3.5 Sonnet dan Claude 3 Opus, serta 20.000 token pada Claude 3.5 Haiku. Prompt yang lebih pendek tidak dapat di-cache dan selalu ditagih dengan tarif input standar.

Batch API memungkinkan mengunggah kumpulan permintaan yang diproses secara asinkron dalam 24 jam, bukan real-time. Sebagai kompensasi atas jeda itu, Anthropic memberikan diskon tetap 50 % untuk token input dan output di semua model. Aktifkan opsi Batch API di kalkulator ini untuk menerapkan diskon tersebut.

Sebagai aturan umum, 1 token sekitar 4 karakter teks bahasa Inggris, atau kira-kira 0,75 kata. Jadi 100 kata sama dengan sekitar 133 token, dan 1.000 kata sekitar 1.333 token. Token output bisa bervariasi tergantung kompleksitas jawaban dan pemformatan (seperti kode atau tag JSON yang memakan lebih banyak token).

Ya, harga dasar model Claude yang di-host di Amazon Bedrock atau Google Vertex AI umumnya sama dengan tarif langsung Anthropic. Namun bisa ada biaya tambahan regional atau diskon enterprise khusus dari penyedia cloud Anda. Gunakan kalkulator ini sebagai estimasi dasar.

Ya, sepenuhnya. Kalkulator biaya Claude berjalan seluruhnya di browser Anda dengan JavaScript. Tidak ada angka token, volume permintaan, atau data proyek yang dikirim ke server eksternal maupun disimpan. Perhitungan Anda sepenuhnya privat.