Penampil Kode Titik Unicode
Lihat informasi Unicode terperinci untuk setiap karakter dalam teks apa pun dengan penampil kode titik Unicode online gratis kami. Tempel atau ketik teks apa pun untuk langsung melihat kode titik U+ setiap karakter, nama resmi Unicode, kategori umum (Lu, Ll, Nd, Po, dsb.), blok Unicode, serta sekuens byte UTF-8 dan UTF-16 yang lengkap. Filter berdasarkan kategori atau blok, cari berdasarkan nama atau kode titik, dan jelajahi detail lengkap per karakter - semua diproses secara lokal di browser Anda tanpa unggahan. Tanpa pendaftaran.
Paste or type any text to view detailed Unicode information for each character - code point, name, category, block, UTF-8 and UTF-16 byte sequences, and more. All processing is local.
Paste or type text above to view detailed Unicode code point information for every character.
Mengapa menggunakan penampil kode titik Unicode kami?
- Informasi Unicode lengkap: lihat setiap detail setiap karakter dalam teks Anda - kode titik Unicode (U+), nilai desimal, nama resmi karakter, kategori umum, blok Unicode, serta sekuens byte UTF-8/UTF-16 - dalam tabel yang jelas dan dapat diurutkan.
- Analisis real-time: dapatkan analisis kode titik Unicode secara instan saat Anda mengetik atau menempel teks. Kartu ringkasan menampilkan total kode titik, jumlah huruf/angka/tanda baca/simbol, serta ukuran total byte untuk UTF-8 dan UTF-16 - diperbarui secara real-time.
- Pemfilteran dan pencarian yang kuat: filter kode titik berdasarkan kategori (Lu, Ll, Nd, Po, dsb.) atau blok Unicode dengan satu klik. Cari berdasarkan kode titik, nama karakter, blok, atau atribut apa pun. Klik baris mana pun untuk melihat detail dengan nilai yang dapat disalin.
- 100 % gratis dan privat: penampil kode titik Unicode kami sepenuhnya gratis, tanpa pendaftaran, tanpa iklan, dan tanpa batas penggunaan. Semua analisis berjalan lokal di browser Anda - teks Anda tidak pernah meninggalkan perangkat. Tidak ada data yang diunggah ke server.
Kasus penggunaan umum penampil kode titik Unicode
- Men-debug masalah pengodean: saat teks tampil sebagai karakter rusak atau mojibake, gunakan penampil kode titik Unicode untuk memeriksa setiap karakter pada tingkat byte. Bandingkan sekuens UTF-8 dan UTF-16 untuk mengidentifikasi ketidakcocokan pengodean dan memperbaiki teks yang rusak.
- Pengembangan dan pengujian perangkat lunak: pengembang dapat memakai penampil untuk memverifikasi penanganan Unicode di aplikasinya - memastikan pemrosesan string menangani karakter multibyte, pasangan pengganti, tanda penggabung, dan karakter lebar nol dengan benar selama pengembangan dan pengujian.
- Pekerjaan internasionalisasi (i18n): saat menangani konten multibahasa, gunakan penampil kode titik Unicode untuk memahami bagaimana berbagai aksara - dari Latin dan Kiril hingga ideograf CJK, Arab, Devanagari, dan emoji - dikodekan dan direpresentasikan di berbagai blok Unicode.
- Analisis font dan tipografi: profesional tipografi dapat menganalisis teks karakter demi karakter untuk memahami kode titik Unicode mana yang dipakai, mengidentifikasi karakter tak terlihat, memeriksa spasi nonstandar, dan memverifikasi cakupan font di berbagai blok Unicode.
- Pembersihan dan normalisasi data: saat membersihkan kumpulan data, gunakan penampil untuk mengidentifikasi karakter lebar nol, pemisah tak terlihat, karakter kontrol, dan kode titik tak terlihat lain yang dapat menyebabkan masalah pemrosesan, kegagalan perbandingan string, atau masalah penyimpanan.
- Pembelajaran dan pendidikan: siswa dan pengajar dapat menjelajahi standar Unicode secara interaktif - melihat bagaimana UTF-8 dan UTF-16 mengodekan karakter yang sama secara berbeda, memahami struktur blok dan kategori Unicode, serta mempelajari dasar-dasar pengodean karakter.
Apa itu kode titik Unicode?
Kode titik Unicode adalah nomor unik yang diberikan pada setiap karakter dalam standar Unicode. Setiap kode titik ditulis sebagai U+ diikuti bilangan heksadesimal (misalnya U+0041 untuk huruf Latin A, U+4E00 untuk ideograf CJK 一, atau U+1F600 untuk emoji wajah menyeringai 😀). Standar Unicode mendefinisikan lebih dari 149.000 karakter dalam 161 aksara dan ratusan blok, menjadikannya sistem pengodean karakter universal yang dipakai hampir semua perangkat lunak modern dan web. Penampil kode titik Unicode kami memungkinkan Anda menjelajahi setiap karakter dalam teks apa pun, menampilkan kode titik, nama resmi, kategori, blok, dan pengodean tingkat byte-nya.
Cara menggunakan penampil kode titik Unicode ini
- 1. Masukkan atau tempel teks: ketik atau tempel teks apa pun ke area masukan. Alat langsung menganalisis setiap karakter dan menampilkan informasi Unicode terperinci untuk setiap kode titik dalam tabel yang dapat diurutkan. Karakter ditelusuri berdasarkan kode titik Unicode, bukan berdasarkan klaster grafem yang terlihat.
- 2. Tinjau statistik ringkasan: kartu ringkasan menampilkan total kode titik, jumlah huruf/angka/tanda baca/simbol, serta ukuran total byte untuk UTF-8 dan UTF-16. Grafik distribusi kategori dan blok membantu Anda memahami komposisi teks secara sekilas.
- 3. Filter, cari, dan jelajahi: gunakan kotak pencarian untuk menemukan karakter tertentu berdasarkan nama atau kode titik. Filter berdasarkan kategori Unicode (Lu untuk huruf besar, Nd untuk angka, dsb.) atau blok Unicode. Klik baris mana pun untuk membuka informasi terperinci termasuk sekuens byte UTF-8/UTF-16, entitas HTML, dan sekuens escape JSON - semuanya dapat disalin untuk proyek Anda.
Konsep Unicode penting yang dijelaskan alat ini
- Kode titik vs unit kode: kode titik (U+0041) adalah pengenal abstrak karakter. Unit kode adalah sekuens byte sebenarnya yang dipakai untuk menyimpan atau mengirim karakter - UTF-8 memakai 1-4 byte per kode titik, sedangkan UTF-16 memakai 1-2 unit 16-bit (2-4 byte). Karakter di atas U+FFFF memerlukan dua unit kode UTF-16, yang disebut pasangan pengganti.
- Kategori Unicode: setiap kode titik termasuk dalam kategori umum yang ditandai kode dua huruf: Lu (huruf besar), Ll (huruf kecil), Nd (angka desimal), Po (tanda baca lain), Sm (simbol matematika), Sc (simbol mata uang), dan banyak lagi. Huruf pertama menunjukkan kelas utama: L (huruf), N (angka), P (tanda baca), S (simbol), Z (pemisah), C (kontrol), M (tanda).
- Blok Unicode: karakter diatur dalam rentang berurutan yang disebut blok, masing-masing mencakup satu aksara atau kategori - Basic Latin, Kiril, Ideograf CJK Terpadu, Emotikon, Operator Matematika, dan lebih dari 250 lainnya. Setiap blok memiliki nama dan rentang kode titik yang ditentukan.
- Pengodean UTF-8 dan UTF-16: UTF-8 adalah pengodean dominan di web dengan sekuens byte berpanjang variabel (1-4 byte per kode titik) yang kompatibel mundur dengan ASCII. UTF-16 memakai 2 atau 4 byte per kode titik dan dipakai oleh string JavaScript serta banyak API sistem. Alat ini menampilkan kedua pengodean untuk setiap karakter sehingga Anda dapat melihat perbedaannya.
Keterbatasan dan pertimbangan kode titik Unicode
Meskipun penampil kode titik Unicode kami memberikan analisis menyeluruh atas kode titik individual, ada konsep penting yang perlu dipahami. Kode titik tidak sama dengan karakter yang terlihat - satu klaster grafem yang terlihat dapat terdiri atas beberapa kode titik (misalnya huruf dasar diikuti tanda diakritik penggabung, atau emoji diikuti pemilih variasi). Alat menganalisis kode titik satu per satu, sehingga sekuens karakter penggabung ditampilkan sebagai entri terpisah. Karakter di luar Basic Multilingual Plane (BMP), termasuk sebagian besar emoji dan banyak karakter CJK, memakai pasangan pengganti dalam UTF-16 yang ditampilkan sebagai dua unit kode. Basis data nama karakter mencakup ASCII umum, Tambahan Latin-1, dan karakter Unicode populer - karakter di luar rentang itu menampilkan kode titiknya sebagai nama cadangan. Semua analisis dilakukan sepenuhnya di browser Anda - tidak ada data yang diunggah ke server.
Pertanyaan yang Sering Diajukan
Kode titik Unicode adalah nomor unik yang diberikan pada setiap karakter dalam standar Unicode. Ditulis sebagai U+ diikuti bilangan heksadesimal - misalnya U+0041 untuk huruf A, U+00A9 untuk tanda hak cipta ©, atau U+1F600 untuk emoji wajah menyeringai 😀. Setiap kode titik mewakili karakter tertentu tanpa memedulikan platform, program, atau bahasa.
Kode titik (misalnya U+1F600) adalah pengenal abstrak karakter. Unit kode adalah satuan berukuran tetap yang dipakai pengodean tertentu - UTF-16 memakai unit 16-bit, sehingga U+1F600 menjadi dua unit kode (D83D DE00) yang disebut pasangan pengganti. Byte adalah nilai 8-bit sebenarnya yang disimpan di memori atau dikirim - UTF-8 mengodekan U+1F600 sebagai empat byte (F0 9F 98 80). Penampil kode titik Unicode kami menampilkan ketiga representasi tersebut.
Kategori Unicode (disebut juga kategori umum) mengklasifikasikan setiap kode titik berdasarkan fungsi utamanya. Kategori utamanya: Huruf (L), Tanda (M), Angka (N), Tanda Baca (P), Simbol (S), Pemisah (Z), dan Lainnya (C). Masing-masing punya subkategori - misalnya Lu adalah huruf besar, Ll huruf kecil, Nd angka desimal, Po tanda baca lain, dan Sm simbol matematika.
Blok Unicode adalah rentang kode titik yang berurutan dan mengelompokkan karakter berdasarkan aksara atau tema. Misalnya Basic Latin (U+0000-U+007F) mencakup ASCII, Kiril (U+0400-U+04FF) mencakup bahasa Rusia dan aksara terkait, Ideograf CJK Terpadu (U+4E00-U+9FFF) mencakup karakter Tionghoa, dan Emotikon (U+1F600-U+1F64F) mencakup wajah emoji.
UTF-8 adalah pengodean berlebar variabel yang memakai 1 hingga 4 byte per kode titik. Karakter ASCII (U+0000-U+007F) memakai 1 byte. Karakter hingga U+07FF memakai 2 byte, hingga U+FFFF memakai 3 byte, dan di atas U+FFFF memakai 4 byte. UTF-8 mendominasi web karena kompatibel dengan ASCII dan efisien.
Satu karakter yang terlihat (klaster grafem) dapat terdiri atas beberapa kode titik Unicode. Contoh umum: huruf dasar diikuti tanda diakritik penggabung, emoji dengan sekuens ZWJ (misalnya keluarga 👨👩👧👦), dan bendera yang dikodekan sebagai pasangan indikator regional. Penampil kami menampilkan setiap kode titik dalam sekuens tersebut secara terpisah.
Ya - 100 % gratis selamanya, tanpa pendaftaran, tanpa iklan, dan tanpa batas penggunaan. Semua analisis berjalan sepenuhnya di browser Anda. Teks Anda tidak pernah diunggah ke server mana pun. Anda dapat menganalisis teks apa pun dengan aman, termasuk kata sandi, dokumen rahasia, dan riset keamanan.