Lompat ke konten
Aback Tools Logo

Kalkulator Biaya AWS Bedrock

Estimasi biaya inferensi API Amazon Bedrock untuk model Anthropic Claude, Amazon Nova, Meta Llama, Mistral, dan Cohere. Hitung pengeluaran per permintaan, terapkan diskon inferensi batch (50 % off) dan cache prompt, bandingkan harga model secara berdampingan, serta proyeksikan pengeluaran harian, bulanan, atau tahunan — 100 % gratis dan sepenuhnya di browser Anda.

AWS Bedrock Cost Calculator

Estimate on-demand inference costs across Anthropic Claude, Amazon Nova, Meta Llama, Mistral, and Cohere models. Configure prompt caching, Batch API discounts, and forecast daily, monthly, or yearly API spend - entirely in your browser.

Provider: AnthropicInput/1M: $3.000Output/1M: $15.000Cache/1M: $0.300Context: 1,000,000 tokens

Prompt Token Counts

tokens
tokens

Cost Optimizations

Workload Volume

reqs

Projected Monthly Workload Cost

$900.00for 30,000 total requests

Cost per Single Call

$0.0300

Input Token Cost

$0.0150

Output Token Cost

$0.0150

Model Comparison (Monthly Forecast)

ModelCost/CallMonthly TotalFeatures
Amazon Nova MicroBest Value
Amazon · In: $0.035/M · Out: $0.140/M
$0.000315$9.45Std
Amazon Nova LiteBest Value
Amazon · In: $0.060/M · Out: $0.240/M
$0.000540$16.20Caching ✓
Mistral Small 3Best Value
Mistral AI · In: $0.100/M · Out: $0.300/M
$0.000800$24.00Std
Claude 3 HaikuBest Value
Anthropic · In: $0.250/M · Out: $1.250/M
$0.002500$75.00Caching ✓
Cohere Command RBest Value
Cohere · In: $0.500/M · Out: $1.500/M
$0.004000$120.00Std
Meta Llama 3.3 70B InstructBest Value
Meta · In: $0.720/M · Out: $0.720/M
$0.004320$129.60Std
Meta Llama 3.1 70B Instruct
Meta · In: $0.720/M · Out: $0.720/M
$0.004320$129.60Std
Amazon Nova ProCapable
Amazon · In: $0.800/M · Out: $3.200/M
$0.007200$216.00Caching ✓
Claude 3.5 HaikuBest Value
Anthropic · In: $0.800/M · Out: $4.000/M
$0.008000$240.00Caching ✓
Mistral Large 2 (2411)Capable
Mistral AI · In: $2.000/M · Out: $6.000/M
$0.0160$480.00Std
Meta Llama 3.1 405B InstructCapable
Meta · In: $2.650/M · Out: $3.500/M
$0.0168$502.50Std
Cohere Command R+
Cohere · In: $2.500/M · Out: $10.000/M
$0.0225$675.00Std
Claude Sonnet 4 (Latest)Capable Selected
Anthropic · In: $3.000/M · Out: $15.000/M
$0.0300$900.00Caching ✓
Claude 3.7 SonnetCapable
Anthropic · In: $3.000/M · Out: $15.000/M
$0.0300$900.00Caching ✓
Claude 3.5 Sonnet v2
Anthropic · In: $3.000/M · Out: $15.000/M
$0.0300$900.00Caching ✓
Claude 3 OpusCapable
Anthropic · In: $15.000/M · Out: $75.000/M
$0.1500$4,500.00Caching ✓
Disclaimer: Rates reflect US-East-1 (N. Virginia) on-demand pricing. Actual bills may vary by AWS region, EDP commitments, AWS Free Tier credits, or model version updates. Prompt caching discount depth varies by model (typically 75-90% off standard input rates). Always verify against the official AWS Bedrock pricing page before committing budget. All calculations run locally in your browser - no data is sent to any server.

Apa yang menentukan biaya per panggilan di Bedrock

Di Bedrock, biaya bukan berasal dari tarif tetap, melainkan dari jumlah token input dan output per permintaan. Dua aplikasi dengan jumlah panggilan sama bisa punya tagihan sangat berbeda.

Masukkan token input dan output per permintaan, volume permintaan, dan model yang dipilih untuk melihat biaya nyata per panggilan serta proyeksi pengeluaran.

  • Token output 3 sampai 10 kali lebih mahal daripada token input: panjang jawaban adalah tuas paling langsung.
  • Inferensi batch memberi diskon tetap 50 % saat latensi real-time tidak diperlukan.
  • Cache prompt menurunkan biaya prefiks yang berulang pada konteks statis panjang sebesar 75-90 %.

Memilih model dan cara penagihan

Model paling canggih jarang yang paling hemat untuk semua tugas. Memisahkan beban berdasarkan kompleksitas biasanya lebih menghemat daripada optimasi teknis apa pun.

  • Nova Micro dan Nova Lite menangani tugas teks umum dengan biaya sangat rendah.
  • Provisioned Throughput masuk akal saat trafik tinggi dan stabil: bisa 40-60 % lebih murah.
  • Komitmen PTU berlaku 1 atau 6 bulan, jadi pastikan stabilitas volume Anda.

Memakai proyeksi secara bijak

Proyeksi adalah alat perencanaan, bukan tagihan. Bandingkan dengan tagihan nyata bulan pertama dan sesuaikan asumsi token serta volume.

  1. Ukur token input dan output nyata pada satu permintaan representatif.
  2. Masukkan volume harian, bulanan, atau tahunan yang Anda harapkan.
  3. Pilih model dan wilayah referensi untuk mendapatkan biaya proyeksi.
  4. Terapkan diskon batch atau cache lalu bandingkan skenario teroptimasi dengan dasar.

Pertanyaan yang Sering Diajukan

Ini alat online yang memperkirakan pengeluaran API Amazon Bedrock Anda berdasarkan jumlah token input dan output, pilihan model, dan volume permintaan. Alat ini memproyeksikan biaya per panggilan lalu menskalakannya menjadi proyeksi harian, bulanan, atau tahunan. Kalkulator kami berjalan sepenuhnya di browser — tidak ada data yang diunggah atau disimpan.

Kalkulator memakai tarif token on-demand wilayah us-east-1 (Virginia Utara) dari halaman harga resmi AWS Bedrock. Tagihan nyata bisa sedikit berbeda karena variasi harga antar wilayah, diskon komitmen EDP, kredit promosi, pembaruan versi model, atau biaya transfer data pada inferensi lintas wilayah.

Harga on-demand menagih per token yang dipakai tanpa komitmen awal — ideal untuk beban variabel dan tak terduga. Provisioned Throughput Units (PTU) memesan kapasitas model khusus dengan tarif per jam tetap, biasanya 40-60 % lebih murah untuk trafik tinggi yang stabil. Komitmen PTU memerlukan jangka waktu 1 atau 6 bulan.

Layanan ini memproses permintaan secara asinkron di latar belakang dan mengembalikan hasil dalam 24 jam. AWS memberi diskon tetap 50 % untuk semua biaya token input dan output dibanding tarif on-demand. Ideal untuk pemrosesan dokumen massal, evaluasi malam hari, penerjemahan kumpulan data, dan beban kerja yang tidak butuh respons real-time.

Cache prompt menyimpan konten yang sering dipakai ulang (prompt sistem panjang, dokumen referensi RAG, blok instruksi besar) di infrastruktur AWS. Pada panggilan berikutnya yang memakai prefiks cache yang sama, bagian itu ditagih 75-90 % lebih murah daripada tarif token input standar. Sangat efektif untuk arsitektur chatbot atau agen dengan konteks sistem besar dan statis.

Token output dihasilkan secara berurutan dan autoregresif — setiap token butuh satu forward pass penuh melalui model, yang jauh lebih berat secara komputasi daripada memproses token input. Sebagian besar model Bedrock menetapkan harga output 3 sampai 10 kali tarif input. Menjaga jawaban tetap ringkas adalah cara paling langsung menurunkan biaya per panggilan.

Untuk beban teks saja dan serbaguna, Amazon Nova Micro dan Amazon Nova Lite adalah model paling hemat di AWS Bedrock, dengan Nova Micro mulai $0,035 per juta token input. Untuk tugas yang butuh kecerdasan lebih tinggi, Claude 3.5 Haiku atau Claude 3 Haiku menawarkan rasio kualitas-harga yang sangat baik. Gunakan tabel perbandingan di kalkulator ini.

Ya. Kalkulator berjalan sepenuhnya di sisi klien, di browser Anda. Jumlah token, volume permintaan, pilihan model, dan semua proyeksi biaya dihitung lokal di perangkat Anda dan tidak pernah dikirim ke server, disimpan, maupun dicatat. Data perencanaan anggaran Anda tetap sepenuhnya privat.