Lompat ke konten
Aback Tools Logo

Penghitung Token

Hitung token, kata, karakter, dan kalimat dari teks apa pun — seketika dan gratis. Tempel teks atau unggah file untuk melihat estimasi token di GPT-4o, Claude, Gemini, DeepSeek, Grok, dan Mistral. Visualisasikan pemakaian jendela konteks dan estimasi biaya input API. Berjalan 100 % di browser Anda tanpa pendaftaran.

Token Counter

Paste or type any text below to instantly count tokens, words, characters, and sentences. Select a model to see estimated token counts and API input costs. Runs 100% in your browser - no data is sent anywhere.

~3.8 chars/tokenContext: 128,000 tokensInput/1M: $2.50

0 characters

Tokens

-

GPT-4o

Words

-

Characters

-

incl. spaces

No-Space Chars

-

Sentences

-

Lines

-

Estimation Disclaimer:Token counts are estimates based on the average characters-per-token ratio for each model family (~3.8-4.0 for English prose). Actual token counts may differ slightly from values returned by each provider's exact tokenizer (e.g. tiktoken for OpenAI, Claude's SentencePiece). For precise counts, use the provider's official tokenizer library. Code, non-English text, and special characters typically tokenize differently than prose.

Apa yang diukur penghitung

Jumlah token bergantung pada model: tiap keluarga memakai tokenizer berbeda. Teks yang sama tidak memberi angka sama di GPT-4o, Claude, atau Gemini.

Selain token, alat ini menampilkan kata, karakter, kalimat, dan persentase jendela konteks yang terpakai.

  • Estimasi token per model (GPT-4o, Claude, Gemini, DeepSeek, Grok, Mistral).
  • Kata, karakter, dan kalimat untuk mengukur ukuran prompt.
  • Pemakaian jendela konteks dan estimasi biaya input.

Kapan estimasi cukup dan kapan perlu tokenizer resmi

Untuk menyusun anggaran dan mengukur prompt, estimasi sudah cukup. Untuk penagihan persis atau batas ketat, tokenizer penyedia lebih baik.

  • Prosa Inggris: simpangan tipikal ±5-10 %.
  • Kode dengan banyak simbol dan emoji: simpangan lebih besar.
  • Untuk akurasi penuh: tiktoken, countTokens Anthropic atau Google.

Privasi dan penggunaan

Semua pemrosesan terjadi di browser Anda, jadi Anda bisa menempel materi rahasia tanpa risiko.

  1. Tempel prompt Anda atau unggah file teks biasa.
  2. Pilih model target untuk melihat jumlah tokennya.
  3. Periksa pemakaian jendela konteks.
  4. Tinjau estimasi biaya input sebelum mengirim permintaan.

Pertanyaan yang Sering Diajukan

Alat ini memperkirakan berapa token yang dikandung sebuah teks untuk model bahasa tertentu. Token adalah unit yang diproses LLM — sekitar 3,8-4,0 karakter per token dalam bahasa Inggris. Penghitung juga mengukur kata, karakter, dan kalimat, serta menampilkan pemakaian jendela konteks model yang dipilih.

Estimasi akurat dalam ±5-10 % untuk prosa Inggris tipikal dan kode. Setiap model memakai rasio rata-rata karakter-per-token yang dipublikasikan. Untuk hitungan persis, gunakan tokenizer resmi penyedia (tiktoken OpenAI, endpoint countTokens Anthropic, atau API countTokens Google). Teks non-Inggris, kode dengan banyak simbol, dan emoji ditokenisasi berbeda dan bisa menyimpang lebih besar.

Tidak. Penghitung berjalan 100 % di browser Anda. Teks Anda tidak pernah diunggah, disimpan, atau dikirim ke mana pun. Semua penghitungan (token, kata, karakter, kalimat) dihitung lokal di perangkat Anda. Karena itu aman untuk prompt rahasia, kode proprietary, dokumen hukum, dan teks sensitif apa pun.

Setiap keluarga LLM memakai tokenizer dengan kosakata berbeda. tiktoken OpenAI (untuk GPT-4o) rata-rata ~3,8 karakter per token untuk bahasa Inggris. Tokenizer Claude ~3,9. Gemini dan Mistral ~4,0. Teks yang sama menghasilkan jumlah token sedikit berbeda tergantung tokenizernya.

Ini jumlah maksimum token yang bisa diproses LLM dalam satu permintaan — termasuk prompt, riwayat percakapan, dokumen yang diambil, dan jawaban yang dihasilkan. Jika input melebihi jendela, model akan memotong atau menolak permintaan. Penghitung menunjukkan persis berapa bagian jendela model terpilih yang terpakai oleh teks Anda.

Bisa. Klik «Unggah file» untuk memuat file teks biasa langsung ke penghitung. Format yang didukung: .txt, .md, .json, .csv, .html, .xml, .yaml, .js, .ts, .py, .java, .go, .rs, .cpp, dan lainnya. File dibaca lokal di browser dan tidak pernah diunggah ke server.

Biaya input dihitung dengan mengalikan estimasi jumlah token dengan tarif input standar per juta token model yang dipilih. Misalnya, teks Anda diperkirakan 1.000 token dan model berbiaya US$ 2,50 per juta token input, maka estimasi biayanya US$ 0,0025. Biaya nyata bisa berbeda sedikit karena perbedaan tokenisasi dan diskon yang berlaku.