Kalkulator Biaya OpenAI
Estimasi dan proyeksikan biaya API OpenAI Anda dengan presisi. Pilih model terbaru seperti GPT-5.5, o3, dan GPT-4o, gunakan estimator token bawaan untuk menempel teks prompt, pertimbangkan diskon cache prompt, dan bandingkan struktur harga antar model secara berdampingan. 100 % privat dan berjalan sepenuhnya di browser Anda.
Estimate standard and cached input/output token pricing, configure Batch discounts, and analyze overall API workloads and model comparisons locally.
Prompt Tokens
Cost Optimizations
Workload Call Volume
Projected Monthly Workload Cost
Cost per Single Call
$0.0550
Input Token Cost
$0.0250
Output Token Cost
$0.0300
Model Pricing Comparisons
Sorted by lowest cost| Model Name | Cost/Call | Monthly Forecast | Optimization Match |
|---|---|---|---|
GPT-4o MiniCost-Effective In: $0.15/M • Out: $0.60/M • Cache: $0.07/M | $0.001350 | $40.50 | Caching Supported |
GPT-5.4 NanoCost-Effective In: $0.20/M • Out: $1.25/M • Cache: $0.02/M | $0.002250 | $67.50 | Caching Supported |
GPT-3.5 Turbo In: $0.50/M • Out: $1.50/M • Cache: $0.50/M | $0.004000 | $120.00 | Caching Supported |
GPT-5.4 MiniCost-Effective In: $0.75/M • Out: $4.50/M • Cache: $0.07/M | $0.008250 | $247.50 | Caching Supported |
o4-miniCost-Effective In: $1.10/M • Out: $4.40/M • Cache: $0.55/M | $0.009900 | $297.00 | Caching Supported |
o3 (Reasoning)Capable In: $2.00/M • Out: $8.00/M • Cache: $1.00/M | $0.0180 | $540.00 | Caching Supported |
GPT-4oCapable In: $2.50/M • Out: $10.00/M • Cache: $1.25/M | $0.0225 | $675.00 | Caching Supported |
GPT-5.4Capable In: $2.50/M • Out: $15.00/M • Cache: $0.25/M | $0.0275 | $825.00 | Caching Supported |
GPT-5.5 (New Flagship)Capable Selected In: $5.00/M • Out: $30.00/M • Cache: $0.50/M | $0.0550 | $1,650.00 | Caching Supported |
GPT-4 Turbo In: $10.00/M • Out: $30.00/M • Cache: $5.00/M | $0.0800 | $2,400.00 | Caching Supported |
GPT-4 (Legacy) In: $30.00/M • Out: $60.00/M • Cache: $30.00/M | $0.2100 | $6,300.00 | Caching Supported |
GPT-5.5 ProCapable In: $30.00/M • Out: $180.00/M • Cache: $15.00/M | $0.3300 | $9,900.00 | Caching Supported |
Apa yang menentukan biaya di API OpenAI
Biaya bergantung pada jumlah kueri, ukuran input dan output masing-masing, serta model yang dipilih. Token output lebih mahal daripada token input.
Model reasoning menambah token internal yang tak terlihat di jawaban tetapi tetap ditagih.
- Token input, input cache, dan output ditagih terpisah.
- Diskon Batch API adalah 50 % untuk semua jenis itu.
- Token reasoning dihitung sebagai token output.
Memanfaatkan cache prompt
Jika prompt Anda punya prefiks stabil lebih dari 1.024 token (instruksi sistem, contoh tetap, konteks dokumen), cache sangat menurunkan harganya.
- Identifikasi bagian tetap yang berulang pada prompt Anda.
- Ukur berapa token input untuk prefiks stabil itu.
- Masukkan ke kolom token cache untuk melihat penghematannya.
- Jika latensi tidak kritis, aktifkan juga Batch API.
Membandingkan model dan merencanakan anggaran
Model termahal belum tentu paling hemat: sering kali menyelesaikan tugas dengan lebih sedikit token. Bandingkan biaya per tugas terselesaikan, bukan hanya harga per juta.
- Gunakan perbandingan berdampingan untuk melihat selisih bulanan tepat.
- Sisakan model reasoning untuk tugas yang benar-benar kompleks.
- Klasifikasi dan ekstraksi biasanya cukup dengan model lebih kecil.
Pertanyaan yang Sering Diajukan
Alat online yang memperkirakan biaya API untuk memakai model OpenAI seperti GPT-5.5, o3, dan GPT-4o. Dengan memasukkan jumlah token input, cache, dan output, alat ini menghitung biaya per kueri dan memproyeksikan pengeluaran harian, bulanan, dan tahunan.
OpenAI otomatis men-cache prefiks prompt 1.024 token atau lebih. Permintaan berikutnya yang memakai ulang prefiks itu (seperti instruksi sistem atau contoh few-shot) mendapat diskon 50-90 % pada token input. Kalkulator ini memungkinkan memasukkan token cache secara terpisah agar penghematan itu terestimasi akurat.
Model reasoning (seperti o3 dan o4-mini) menghasilkan token pemikiran internal selama fase pemrosesan. Meski tidak dikembalikan di output API, token ini ditagih dengan harga sama seperti token output standar. Sertakan estimasi token pemikiran di kolom token output kalkulator ini agar anggaran akurat.
Ya! Batch API adalah endpoint OpenAI untuk beban yang tidak sensitif waktu (diproses dalam 24 jam). Permintaan lewat Batch API mendapat diskon tetap 50 % pada token standar, input cache, dan output. Aktifkan tombol Batch API di estimator untuk menerapkan diskon itu otomatis.
Estimator memberi pendekatan dekat berdasarkan rasio token-ke-kata dan karakter-ke-token standar (sekitar 1,3× untuk bahasa Inggris biasa, 1,8× untuk kode/JSON). Untuk presisi 100 %, gunakan pustaka tiktoken resmi OpenAI di kode Anda, tetapi estimator browser kami ideal untuk perkiraan cepat.
Tidak. Alat kami berjalan 100 % lokal di browser Anda. Teks prompt yang ditempel ke estimator token dan angka apa pun yang dimasukkan ke kalkulator diproses lokal di perangkat Anda dan tidak pernah dikirim ke server mana pun atau dicatat.
Centang kotak «Bandingkan dengan model lain» di panel kalkulator. Bagian perbandingan akan muncul, di mana Anda bisa memilih model sekunder (misalnya membandingkan GPT-5.5 dengan GPT-5.4) dan melihat selisih biaya bulanan tepat serta persentase penghematannya.