Kalkulator Biaya Claude
Estimasi biaya API Anthropic Claude Anda secara gratis online. Mendukung pilihan model, estimasi token, cache prompt, diskon Batch API, dan proyeksi bulanan/tahunan. Bandingkan biaya berdampingan antar semua model Claude (termasuk Claude 3.5, Opus, Sonnet, Haiku, dan tingkat generasi baru Claude 5) untuk menemukan keseimbangan terbaik antara kecepatan, kemampuan, dan anggaran. Tanpa pendaftaran — perhitungan berjalan lokal di browser Anda.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0300
Input Token Cost
$0.0150
Output Token Cost
$0.0150
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
Claude 3 Haiku In: $0.25/M • Out: $1.25/M • Cache: $0.03/M | $0.002500 | $75.00 | Caching Supported |
Claude Haiku 4.5Cost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude 3.5 HaikuCost-Effective In: $1.00/M • Out: $5.00/M • Cache: $0.10/M | $0.0100 | $300.00 | Caching Supported |
Claude Sonnet 4.6Capable In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3.5 SonnetCapable Selected In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude 3 Sonnet In: $3.00/M • Out: $15.00/M • Cache: $0.30/M | $0.0300 | $900.00 | Caching Supported |
Claude Opus 4.8Capable In: $5.00/M • Out: $25.00/M • Cache: $0.50/M | $0.0500 | $1,500.00 | Caching Supported |
Claude Fable 5Capable In: $10.00/M • Out: $50.00/M • Cache: $1.00/M | $0.1000 | $3,000.00 | Caching Supported |
Claude 3 Opus In: $15.00/M • Out: $75.00/M • Cache: $1.50/M | $0.1500 | $4,500.00 | Caching Supported |
Memahami struktur biaya Claude
Biaya Claude bergantung pada tiga variabel: model yang dipilih, rasio token input terhadap output, dan volume kueri. Token output biasanya 3 sampai 5 kali lebih mahal daripada token input, sehingga panjang jawaban menentukan tagihan.
Masukkan token input dan output per kueri, volume bulanan, dan model untuk melihat proyeksi dan membandingkan opsi.
- Token output mendominasi biaya per kueri: mengendalikan panjang jawaban adalah tuas paling efektif.
- Cache prompt dapat memangkas hingga 90 % biaya token input yang dipakai ulang.
- Batch API memberi diskon tetap 50 % saat jawaban real-time tidak diperlukan.
Kapan masing-masing penghematan layak
Cache dan Batch tidak selalu membantu. Cache butuh prompt panjang yang berulang; Batch mengharuskan Anda menoleransi latensi 24 jam.
- Cache: berguna untuk prompt sistem panjang dan stabil yang berulang di setiap kueri.
- Batch: berguna untuk pemrosesan massal, evaluasi, dan tugas yang bisa menunggu.
- Keduanya tidak menurunkan biaya satu prompt pendek sekali pakai.
Menyusun anggaran dengan margin aman
Estimasi hanya sebaik asumsi token Anda. Ukur sampel nyata sebelum mengekstrapolasi ke seluruh volume.
- Ukur token input dan output nyata pada sampel kueri yang representatif.
- Masukkan volume bulanan yang diperkirakan dan pilih modelnya.
- Aktifkan cache atau Batch bila pola pemakaian Anda cocok, lalu bandingkan skenario teroptimasi.
- Tambahkan margin 20-30 % untuk variasi panjang dan pertumbuhan pemakaian.
Pertanyaan yang Sering Diajukan
Ini alat untuk memperkirakan biaya penggunaan API Anthropic Claude. Dengan memasukkan token input/prompt, token output/penyelesaian, volume kueri, dan memilih model tertentu, developer dan founder SaaS bisa memproyeksikan pengeluaran bulanan/tahunan serta membandingkan biaya antar model.
Cache prompt sangat menurunkan biaya (hingga 90 %) untuk token input yang Anda pakai ulang di beberapa kueri. Saat diaktifkan, hanya token yang tidak di-cache yang ditagih dengan tarif standar; token yang di-cache ditagih dengan tarif baca yang jauh lebih rendah. Misalnya, pada Claude 3.5 Sonnet, pembacaan cache berbiaya $0,30/juta token dibanding $3,00/juta pada tarif standar.
Cache prompt memerlukan panjang prompt minimal 10.000 token pada Claude 3.5 Sonnet dan Claude 3 Opus, serta 20.000 token pada Claude 3.5 Haiku. Prompt yang lebih pendek tidak dapat di-cache dan selalu ditagih dengan tarif input standar.
Batch API memungkinkan mengunggah kumpulan permintaan yang diproses secara asinkron dalam 24 jam, bukan real-time. Sebagai kompensasi atas jeda itu, Anthropic memberikan diskon tetap 50 % untuk token input dan output di semua model. Aktifkan opsi Batch API di kalkulator ini untuk menerapkan diskon tersebut.
Sebagai aturan umum, 1 token sekitar 4 karakter teks bahasa Inggris, atau kira-kira 0,75 kata. Jadi 100 kata sama dengan sekitar 133 token, dan 1.000 kata sekitar 1.333 token. Token output bisa bervariasi tergantung kompleksitas jawaban dan pemformatan (seperti kode atau tag JSON yang memakan lebih banyak token).
Ya, harga dasar model Claude yang di-host di Amazon Bedrock atau Google Vertex AI umumnya sama dengan tarif langsung Anthropic. Namun bisa ada biaya tambahan regional atau diskon enterprise khusus dari penyedia cloud Anda. Gunakan kalkulator ini sebagai estimasi dasar.
Ya, sepenuhnya. Kalkulator biaya Claude berjalan seluruhnya di browser Anda dengan JavaScript. Tidak ada angka token, volume permintaan, atau data proyek yang dikirim ke server eksternal maupun disimpan. Perhitungan Anda sepenuhnya privat.