Detektor & Perbaikan Mojibake
Deteksi dan perbaiki mojibake (teks rusak akibat ketidakcocokan encoding) online dan gratis. Tempel teks yang rusak untuk mengidentifikasi ketidakcocokan encoding mana yang menyebabkan masalah - apakah UTF-8 dibaca sebagai Latin-1, tanda kutip pintar Windows-1252, kerusakan teks Kiril, atau masalah encoding CJK. Detektor mojibake kami menganalisis teks dan menunjukkan encoding yang salah, encoding yang benar, serta berapa banyak karakter rusak yang ditemukan. Dengan satu klik, perbaikan mojibake otomatis memperbaiki teks dengan menafsirkan ulang byte memakai encoding yang benar. Semua pemrosesan sepenuhnya lokal di browser Anda - tidak ada data yang diunggah, tanpa pendaftaran.
Detect and fix mojibake (garbled text from encoding mismatches). Paste text corrupted by encoding issues to analyze what went wrong and repair it. All processing happens locally in your browser - no data is uploaded to any server.
- Paste garbled text (mojibake) into the left panel, or click a sample button above.
- Click Analyze Encoding to detect what encoding mismatch caused the corruption.
- Click Fix Mojibake to automatically repair the text using the detected patterns.
- Copy or download the fixed text from the right panel.
Mengapa menggunakan detektor & perbaikan mojibake kami?
- Deteksi Mojibake Cerdas: deteksi mojibake pada teks apa pun memakai pengenalan pola dan heuristik encoding. Detektor mojibake kami mengidentifikasi encoding salah yang dipakai dan menyarankan yang benar - baik UTF-8 dibaca sebagai Latin-1, tanda kutip pintar Windows-1252, mojibake Kiril, maupun kerusakan teks CJK.
- Perbaikan Sekali Klik: perbaiki mojibake seketika dengan satu klik. Perbaikan mojibake kami secara otomatis menerapkan interpretasi encoding yang benar untuk memulihkan teks Anda - menangani UTF-8, Latin-1, Windows-1252, dan skenario encoding ganda. Tanpa coba-coba manual.
- Perbaikan Mojibake Online - Tanpa Instalasi: gunakan detektor dan perbaikan mojibake kami langsung di browser apa pun tanpa unduhan, plugin, atau aplikasi. Semua pemrosesan teks terjadi lokal di perangkat Anda - tanpa unggahan, tanpa pemrosesan server, privasi penuh.
- 100% Gratis Selamanya: detektor dan perbaikan mojibake kami sepenuhnya gratis tanpa pendaftaran, tanpa iklan, dan tanpa batas penggunaan. Deteksi dan perbaiki kerusakan encoding pada sebanyak mungkin teks yang Anda butuh - sepenuhnya gratis, selamanya. Semua pemrosesan lokal dan privat.
Kasus penggunaan umum detektor & perbaikan mojibake
- Pemulihan Ekspor Basis Data: perbaiki teks dari ekspor basis data yang encodingnya salah dikonfigurasi saat ekstraksi. Perbaikan mojibake kami menangani skenario umum ketika konten basis data UTF-8 diekspor memakai encoding yang salah, memulihkan nama, alamat, dan konten multibahasa.
- Migrasi Situs Web & CMS: perbaiki konten rusak selama migrasi situs web ketika basis data lama memakai encoding berbeda dari yang diharapkan CMS. Detektor mojibake kami mengidentifikasi ketidakcocokan encoding pada pos, judul, dan metadata yang dimigrasikan.
- Perbaikan Dokumen & Email: pulihkan teks dari dokumen, email, dan berkas teks yang rusak yang tampil sebagai karakter acak akibat masalah encoding. Perbaikan mojibake kami memulihkan karakter beraksen, teks Kiril, dan karakter CJK ke bentuk yang terbaca.
- Pelokalan Perangkat Lunak & i18n: debug masalah encoding pada perangkat lunak terinternasionalisasi dan berkas pelokalan. Detektor mojibake kami membantu pengembang mengidentifikasi mengapa string terjemahan tampak rusak di aplikasi mereka.
- Debugging API & Pipeline Data: atasi kerusakan encoding pada respons API dan pipeline pemrosesan data. Perbaikan mojibake kami membantu pengembang dengan cepat mengidentifikasi dan memperbaiki ketidakcocokan encoding teks antar sistem.
- Pembelajaran & Pendidikan: pahami cara kerja encoding teks dengan melihat contoh nyata mojibake. Detektor mojibake kami adalah alat edukasi yang sangat baik untuk mempelajari UTF-8, Latin-1, Windows-1252, dan bagaimana ketidakcocokan encoding merusak teks.
Apa itu mojibake?
Mojibake (文字化け - secara harfiah "transformasi karakter" dalam bahasa Jepang) adalah teks rusak yang muncul ketika sebuah string didekode memakai encoding karakter yang salah. Ini terjadi ketika sistem atau aplikasi menafsirkan byte teks memakai encoding yang berbeda dari yang dipakai untuk membuatnya. Misalnya, byte UTF-8 dari kata Prancis "déjà vu" ( 64 C3 A9 6A C3 A0 20 76 75 ) akan muncul sebagai "déjà vu" jika dibaca memakai encoding Latin-1 (ISO 8859-1). Detektor mojibake kami mengenali pola ini dengan mencari urutan byte yang dikenal yang dihasilkan dari ketidakcocokan umum, lalu perbaikan mojibake kami membalik kerusakannya dengan menafsirkan ulang byte memakai encoding yang benar.
Cara menggunakan detektor & perbaikan mojibake ini
- 1. Tempel teks yang rusak: salin teks yang tampak acak dan tempel ke panel kiri, atau klik salah satu tombol contoh untuk mencoba contoh mojibake umum (Prancis, Spanyol, Jerman, Rusia, Tionghoa, Tanda Kutip Pintar).
- 2. Klik "Analisis Encoding": detektor mojibake kami memindai teks untuk pola kerusakan yang dikenal dan melaporkan encoding apa yang kemungkinan dipakai untuk mendekode teks, encoding apa yang seharusnya dipakai, dan berapa banyak karakter rusak yang ditemukan.
- 3. Klik "Perbaiki Mojibake": perbaikan mojibake kami secara otomatis menafsirkan ulang byte memakai encoding yang benar, memulihkan teks asli. Setelah itu Anda dapat menyalin atau mengunduh hasil yang telah diperbaiki.
Skenario mojibake umum
- UTF-8 → Latin-1 / Windows-1252: skenario paling umum. Karakter beraksen seperti é, ü, ñ menjadi urutan dua karakter é, ü, ñ. Teks Kiril menjadi urutan tak terbaca yang dimulai dengan Ð. Karakter CJK menjadi urutan yang dimulai dengan ä, æ, dan seterusnya.
- UTF-8 → Windows-1252 (Tanda Kutip Pintar): tanda kutip melengkung, em dash, dan bullet berencoding UTF-8 tampil sebagai ’, “, —, dan seterusnya. Umum pada konten yang disalin dari pengolah kata atau halaman web.
- Encoding Ganda UTF-8: ketika teks UTF-8 secara tak sengaja di encoding UTF-8 untuk kedua kalinya. Byte untuk é (0xC3 0xA9) di-encode ulang menjadi urutan 4 byte 0xC3 0x83 0xC2 0xA9, tampil sebagai é.
- Masalah BOM UTF-8: Byte Order Mark UTF-8 (0xEF BB BF) yang tampil sebagai karakter terlihat "" di awal berkas ketika dibaca memakai encoding yang salah.
Keterbatasan deteksi mojibake
Meskipun detektor mojibake kami menangani skenario ketidakcocokan encoding yang paling umum, ada keterbatasan yang perlu disadari. Detektor memakai pencocokan pola terhadap tanda tangan mojibake yang dikenal, yang berarti mungkin tidak mengenali setiap kemungkinan kerusakan encoding - terutama dengan pasangan yang langka (seperti UTF-8 yang didekode sebagai Shift-JIS atau KOI8-R). Teks pendek (di bawah 10 karakter) mungkin tidak memiliki cukup konten rusak untuk deteksi yang andal. Skor keyakinan mencerminkan berapa banyak pola dikenal yang cocok; hasil dengan keyakinan rendah masih dapat mengandung mojibake yang tidak dikenali. Untuk hasil terbaik, coba tindakan "Perbaiki Mojibake" meskipun detektor tidak menunjukkan masalah - perbaikan menerapkan strategi yang lebih agresif yang dapat mengoreksi pola yang mungkin terlewat oleh detektor. Semua pemrosesan teks dalam detektor dan perbaikan mojibake ini dilakukan sepenuhnya di browser Anda - tidak ada data yang diunggah ke server mana pun dan tidak ada teks yang meninggalkan perangkat Anda.
Pertanyaan yang Sering Diajukan
Mojibake (文字化け) adalah teks rusak yang muncul ketika sebuah string didekode memakai encoding karakter yang salah. Misalnya, ketika teks berencoding UTF-8 dengan karakter beraksen ditafsirkan sebagai Latin-1, karakter seperti é muncul sebagai "é". Detektor mojibake kami mengenali pola ini dan perbaikan kami membalik kerusakannya.
Detektor mojibake kami memindai teks masukan untuk pola kerusakan yang dikenal - urutan byte spesifik yang dihasilkan dari ketidakcocokan encoding umum. Alat ini memeriksa UTF-8→Latin-1, UTF-8→Windows-1252, encoding ganda UTF-8, mojibake Kiril, mojibake CJK, dan artefak BOM. Setiap pola dipetakan ke pasangan encoding yang kemungkinan salah dan benar, dengan skor keyakinan.
Perbaikan mojibake menerapkan kebalikan dari ketidakcocokan yang terdeteksi. Untuk skenario paling umum (teks UTF-8 dibaca sebagai Latin-1), alat ini mengambil karakter yang rusak, mengodekannya kembali ke byte Latin-1, lalu mendekode byte tersebut sebagai UTF-8. Ini memulihkan teks asli. Perbaikan juga mencoba pendekodean ganda jika satu proses belum sepenuhnya mengatasi kerusakan.
Detektor dan perbaikan mojibake kami terutama menangani ketidakcocokan UTF-8↔Latin-1 (ISO 8859-1) dan UTF-8↔Windows-1252, yang mencakup sebagian besar kasus mojibake di praktik. Alat ini juga mendeteksi encoding ganda UTF-8 dan artefak BOM UTF-8. Untuk pasangan yang kurang umum, teks mungkin tidak sepenuhnya dapat dipulihkan.
Bisa. Perbaikan mojibake kami dapat menangani teks dengan panjang apa pun. Semua pemrosesan terjadi lokal di browser Anda, jadi satu-satunya batas adalah memori perangkat Anda. Untuk dokumen yang sangat besar (lebih dari 100.000 karakter), pemrosesan mungkin butuh sejenak tetapi akan selesai tanpa mengunggah data apa pun.
Untuk skenario paling umum (teks UTF-8 dibaca sebagai Latin-1 atau Windows-1252), deteksinya sangat akurat - biasanya 90% atau lebih ketika ada beberapa karakter beraksen atau non-ASCII. Untuk pola yang kurang umum atau teks yang sangat pendek, akurasinya menurun. Skor keyakinan dan rincian masalah yang mendetail membantu Anda menilai keandalan deteksi.
Tentu saja. Detektor dan perbaikan mojibake kami memproses semuanya sepenuhnya di browser Anda. Teks Anda tidak pernah diunggah ke server mana pun, tidak pernah disimpan, dan tidak pernah dikirim ke mana pun. Semua deteksi, analisis, dan perbaikan terjadi lokal di perangkat Anda memakai JavaScript sisi klien. Privasi penuh sudah terpasang pada alat ini sejak desainnya.
"Analisis Encoding" mendeteksi pola mojibake dan menunjukkan ketidakcocokan encoding yang kemungkinan menyebabkan kerusakan - tetapi tidak mengubah teks masukan Anda. "Perbaiki Mojibake" menerapkan algoritma perbaikan untuk menghasilkan teks yang telah dikoreksi di panel keluaran. Gunakan Analisis untuk memahami masalahnya, lalu Perbaiki untuk mendapatkan hasil yang telah diperbaiki.
Ya! Detektor dan perbaikan mojibake kami 100% gratis tanpa pendaftaran, tanpa iklan, dan tanpa batas penggunaan. Deteksi dan perbaiki kerusakan encoding pada sebanyak mungkin teks yang Anda butuh - sepenuhnya gratis, selamanya. Semua pemrosesan terjadi lokal di browser Anda tanpa interaksi server.