Kalkulator Biaya AWS Bedrock
Estimasi biaya inferensi API Amazon Bedrock untuk model Anthropic Claude, Amazon Nova, Meta Llama, Mistral, dan Cohere. Hitung pengeluaran per permintaan, terapkan diskon inferensi batch (50 % off) dan cache prompt, bandingkan harga model secara berdampingan, serta proyeksikan pengeluaran harian, bulanan, atau tahunan — 100 % gratis dan sepenuhnya di browser Anda.
Estimate on-demand inference costs across Anthropic Claude, Amazon Nova, Meta Llama, Mistral, and Cohere models. Configure prompt caching, Batch API discounts, and forecast daily, monthly, or yearly API spend - entirely in your browser.
Prompt Token Counts
Cost Optimizations
Workload Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0300
Input Token Cost
$0.0150
Output Token Cost
$0.0150
Model Comparison (Monthly Forecast)
| Model | Cost/Call | Monthly Total | Features |
|---|---|---|---|
Amazon Nova MicroBest Value Amazon · In: $0.035/M · Out: $0.140/M | $0.000315 | $9.45 | Std |
Amazon Nova LiteBest Value Amazon · In: $0.060/M · Out: $0.240/M | $0.000540 | $16.20 | Caching ✓ |
Mistral Small 3Best Value Mistral AI · In: $0.100/M · Out: $0.300/M | $0.000800 | $24.00 | Std |
Claude 3 HaikuBest Value Anthropic · In: $0.250/M · Out: $1.250/M | $0.002500 | $75.00 | Caching ✓ |
Cohere Command RBest Value Cohere · In: $0.500/M · Out: $1.500/M | $0.004000 | $120.00 | Std |
Meta Llama 3.3 70B InstructBest Value Meta · In: $0.720/M · Out: $0.720/M | $0.004320 | $129.60 | Std |
Meta Llama 3.1 70B Instruct Meta · In: $0.720/M · Out: $0.720/M | $0.004320 | $129.60 | Std |
Amazon Nova ProCapable Amazon · In: $0.800/M · Out: $3.200/M | $0.007200 | $216.00 | Caching ✓ |
Claude 3.5 HaikuBest Value Anthropic · In: $0.800/M · Out: $4.000/M | $0.008000 | $240.00 | Caching ✓ |
Mistral Large 2 (2411)Capable Mistral AI · In: $2.000/M · Out: $6.000/M | $0.0160 | $480.00 | Std |
Meta Llama 3.1 405B InstructCapable Meta · In: $2.650/M · Out: $3.500/M | $0.0168 | $502.50 | Std |
Cohere Command R+ Cohere · In: $2.500/M · Out: $10.000/M | $0.0225 | $675.00 | Std |
Claude Sonnet 4 (Latest)Capable Selected Anthropic · In: $3.000/M · Out: $15.000/M | $0.0300 | $900.00 | Caching ✓ |
Claude 3.7 SonnetCapable Anthropic · In: $3.000/M · Out: $15.000/M | $0.0300 | $900.00 | Caching ✓ |
Claude 3.5 Sonnet v2 Anthropic · In: $3.000/M · Out: $15.000/M | $0.0300 | $900.00 | Caching ✓ |
Claude 3 OpusCapable Anthropic · In: $15.000/M · Out: $75.000/M | $0.1500 | $4,500.00 | Caching ✓ |
Apa yang menentukan biaya per panggilan di Bedrock
Di Bedrock, biaya bukan berasal dari tarif tetap, melainkan dari jumlah token input dan output per permintaan. Dua aplikasi dengan jumlah panggilan sama bisa punya tagihan sangat berbeda.
Masukkan token input dan output per permintaan, volume permintaan, dan model yang dipilih untuk melihat biaya nyata per panggilan serta proyeksi pengeluaran.
- Token output 3 sampai 10 kali lebih mahal daripada token input: panjang jawaban adalah tuas paling langsung.
- Inferensi batch memberi diskon tetap 50 % saat latensi real-time tidak diperlukan.
- Cache prompt menurunkan biaya prefiks yang berulang pada konteks statis panjang sebesar 75-90 %.
Memilih model dan cara penagihan
Model paling canggih jarang yang paling hemat untuk semua tugas. Memisahkan beban berdasarkan kompleksitas biasanya lebih menghemat daripada optimasi teknis apa pun.
- Nova Micro dan Nova Lite menangani tugas teks umum dengan biaya sangat rendah.
- Provisioned Throughput masuk akal saat trafik tinggi dan stabil: bisa 40-60 % lebih murah.
- Komitmen PTU berlaku 1 atau 6 bulan, jadi pastikan stabilitas volume Anda.
Memakai proyeksi secara bijak
Proyeksi adalah alat perencanaan, bukan tagihan. Bandingkan dengan tagihan nyata bulan pertama dan sesuaikan asumsi token serta volume.
- Ukur token input dan output nyata pada satu permintaan representatif.
- Masukkan volume harian, bulanan, atau tahunan yang Anda harapkan.
- Pilih model dan wilayah referensi untuk mendapatkan biaya proyeksi.
- Terapkan diskon batch atau cache lalu bandingkan skenario teroptimasi dengan dasar.
Pertanyaan yang Sering Diajukan
Ini alat online yang memperkirakan pengeluaran API Amazon Bedrock Anda berdasarkan jumlah token input dan output, pilihan model, dan volume permintaan. Alat ini memproyeksikan biaya per panggilan lalu menskalakannya menjadi proyeksi harian, bulanan, atau tahunan. Kalkulator kami berjalan sepenuhnya di browser — tidak ada data yang diunggah atau disimpan.
Kalkulator memakai tarif token on-demand wilayah us-east-1 (Virginia Utara) dari halaman harga resmi AWS Bedrock. Tagihan nyata bisa sedikit berbeda karena variasi harga antar wilayah, diskon komitmen EDP, kredit promosi, pembaruan versi model, atau biaya transfer data pada inferensi lintas wilayah.
Harga on-demand menagih per token yang dipakai tanpa komitmen awal — ideal untuk beban variabel dan tak terduga. Provisioned Throughput Units (PTU) memesan kapasitas model khusus dengan tarif per jam tetap, biasanya 40-60 % lebih murah untuk trafik tinggi yang stabil. Komitmen PTU memerlukan jangka waktu 1 atau 6 bulan.
Layanan ini memproses permintaan secara asinkron di latar belakang dan mengembalikan hasil dalam 24 jam. AWS memberi diskon tetap 50 % untuk semua biaya token input dan output dibanding tarif on-demand. Ideal untuk pemrosesan dokumen massal, evaluasi malam hari, penerjemahan kumpulan data, dan beban kerja yang tidak butuh respons real-time.
Cache prompt menyimpan konten yang sering dipakai ulang (prompt sistem panjang, dokumen referensi RAG, blok instruksi besar) di infrastruktur AWS. Pada panggilan berikutnya yang memakai prefiks cache yang sama, bagian itu ditagih 75-90 % lebih murah daripada tarif token input standar. Sangat efektif untuk arsitektur chatbot atau agen dengan konteks sistem besar dan statis.
Token output dihasilkan secara berurutan dan autoregresif — setiap token butuh satu forward pass penuh melalui model, yang jauh lebih berat secara komputasi daripada memproses token input. Sebagian besar model Bedrock menetapkan harga output 3 sampai 10 kali tarif input. Menjaga jawaban tetap ringkas adalah cara paling langsung menurunkan biaya per panggilan.
Untuk beban teks saja dan serbaguna, Amazon Nova Micro dan Amazon Nova Lite adalah model paling hemat di AWS Bedrock, dengan Nova Micro mulai $0,035 per juta token input. Untuk tugas yang butuh kecerdasan lebih tinggi, Claude 3.5 Haiku atau Claude 3 Haiku menawarkan rasio kualitas-harga yang sangat baik. Gunakan tabel perbandingan di kalkulator ini.
Ya. Kalkulator berjalan sepenuhnya di sisi klien, di browser Anda. Jumlah token, volume permintaan, pilihan model, dan semua proyeksi biaya dihitung lokal di perangkat Anda dan tidak pernah dikirim ke server, disimpan, maupun dicatat. Data perencanaan anggaran Anda tetap sepenuhnya privat.