Lompat ke konten
Aback Tools Logo

Detektor Tanda Urutan Byte (BOM).

Deteksi Byte Order Mark (BOM) di awal file apa pun atau teks yang ditempel. Detektor Tanda Urutan Byte kami membaca byte pertama dan membandingkannya dengan semua tanda tangan BOM yang diketahui - menunjukkan urutan hex, interpretasi pengkodean, dan endianness. Mendukung UTF-8, UTF-16 (BE/LE), UTF-32 (BE/LE), UTF-7, SCSU, BOCU-1, dan GB-18030. Unggah file apa pun atau tempel teks untuk memeriksa karakter BOM yang tersembunyi. Semua pemrosesan berjalan secara lokal di browser Anda - tanpa unggahan, tanpa pendaftaran, sepenuhnya gratis.

Detect Byte Order Mark (BOM)

Upload a file or paste text to detect BOM (Byte Order Mark) at the start. Shows hex sequence, encoding, and endianness.

Drop your file here

or click to browse (any file type supported)

Mengapa Menggunakan Detektor Tanda Urutan Byte Kami?

  • Deteksi BOM Komprehensif: Detektor BOM kami memindai byte pertama file apa pun atau teks yang ditempelkan untuk mendeteksi semua tanda tangan Tanda Urutan Byte yang diketahui. Mendukung pengkodean UTF-8, UTF-16 (BE/LE), UTF-32 (BE/LE), UTF-7, UTF-1, SCSU, BOCU-1, dan GB-18030 dengan identifikasi otomatis.
  • 100% Pemrosesan Browser Pribadi: Detektor BOM memproses semuanya secara lokal di browser Anda. File dan teks Anda tidak pernah keluar dari perangkat Anda, memastikan privasi lengkap untuk dokumen sensitif dan analisis data.
  • Analisis File & Teks Instan: Dapatkan hasil langsung dengan detektor BOM online kami. Unggah file apa pun atau tempel teks dan terima laporan terperinci yang menunjukkan tanda tangan BOM yang terdeteksi, urutan hex, pengkodean, endianness, dan analisis tingkat byte dalam milidetik.
  • Tabel Referensi & Hex Dump Interaktif: Lihat hex dump berkode warna dari 16 byte pertama dengan urutan BOM yang disorot. Tabel referensi lengkap dari semua tanda tangan BOM yang diketahui membantu Anda memahami setiap format pengkodean dan karakteristiknya.

Kasus Penggunaan Umum untuk Detektor Tanda Urutan Byte

  • Men-debug Masalah BOM UTF-8 dalam Skrip: Pengembang menggunakan detektor BOM kami untuk mengidentifikasi byte BOM UTF-8 yang tersembunyi di awal skrip shell, file Python, dan file JavaScript yang menyebabkan kesalahan sintaksis samar atau kegagalan shebang ketika dijalankan pada sistem berbasis Unix.
  • Pemecahan Masalah Pengkodean File CSV & Data: Analis data menggunakan detektor BOM untuk mengidentifikasi karakter BOM dalam CSV dan file data yang menyebabkan kesalahan penguraian pada alat seperti Python pandas, Excel, dan utilitas impor basis data, sehingga memastikan pemrosesan data yang bersih.
  • Pengembangan Web & Validasi HTML: Pengembang web menggunakan detektor BOM kami untuk memeriksa byte BOM yang menyimpang dalam file HTML, CSS, dan JavaScript yang dapat menyebabkan masalah rendering spasi, karakter tak terduga dalam tata letak halaman, atau peringatan validator.
  • Analisis Pengkodean File Lintas Platform: Administrator sistem menggunakan detektor BOM untuk menganalisis file yang ditransfer antara sistem Windows (yang sering kali menambahkan UTF-16 LE BOM), macOS, dan Linux, mengidentifikasi ketidakcocokan pengkodean yang menyebabkan kerusakan file atau masalah tampilan.
  • Debugging Payload API & JSON: Pengembang API menggunakan detektor BOM kami untuk mengidentifikasi karakter BOM dalam payload JSON dan respons API yang menyebabkan kegagalan JSON.parse, urutan byte yang tidak terduga, atau masalah negosiasi tipe konten.
  • Editor Teks & Konfigurasi IDE: Pengguna mengonfigurasi editor teks dan IDE mereka menggunakan detektor BOM kami untuk memverifikasi apakah alat mereka menambahkan penanda BOM ke file, membantu mereka membuat keputusan yang tepat tentang pengaturan pengkodean di VS Code, Sublime Text, dan IntelliJ.

Apa itu Tanda Urutan Byte (BOM)?

Tanda Urutan Byte (BOM) adalah karakter khusus Unicode (U+FEFF ZERO WIDTH NO-BREAK SPACE) yang ditempatkan di awal file teks atau aliran untuk menunjukkan jenis pengkodean dan urutan byte (endianness) data. BOM bertindak sebagai tanda tangan yang membantu perangkat lunak menafsirkan dengan benar pengkodean teks berikutnya. Untuk pengkodean UTF-16 dan UTF-32, BOM secara khusus mengidentifikasi apakah byte berada dalam urutan big-endian (byte paling signifikan pertama) atau little-endian (byte paling signifikan pertama). Meskipun UTF-8 tidak memiliki endianness, BOM-nya (EF BB BF) biasanya digunakan oleh aplikasi Windows untuk menandai file sebagai berkode UTF-8. Detektor Tanda Urutan Byte kami membaca byte pertama file apa pun dan membandingkannya dengan database komprehensif tanda tangan BOM yang diketahui untuk mengidentifikasi pengkodean secara instan.

Cara Kerja Detektor Tanda Urutan Byte Kami

  1. Pembacaan Data Biner: Detektor BOM membaca byte mentah dari file yang Anda unggah atau mengkodekan teks yang Anda tempel menjadi byte menggunakan pengkodean UTF-8. Hanya 16 byte pertama yang diperlukan untuk mendeteksi BOM secara akurat, sehingga prosesnya menjadi sangat cepat bahkan untuk file yang sangat besar.
  2. Pencocokan Tanda Tangan BOM: Detektor membandingkan byte awal dengan semua tanda tangan BOM yang dikenal termasuk UTF-8 (EF BB BF), UTF-16 BE (FE FF), UTF-16 LE (FF FE), UTF-32 BE (00 00 FE FF), UTF-32 LE (FF FE 00 00), UTF-7 (2B 2F 76 38), SCSU (0E FE FF), BOCU-1 (FB EE 28), dan GB-18030 (84 31 95 33). Beberapa kecocokan dilaporkan bila berlaku.
  3. Presentasi Hasil: Detektor menampilkan keputusan yang jelas, hex dump berkode warna dengan byte BOM yang disorot, informasi pengkodean terperinci termasuk endianness dan panjang byte, dan tabel referensi lengkap dari semua tanda tangan BOM yang diketahui untuk tujuan pendidikan.

Apa yang Diungkapkan Detektor BOM Kami

  • Jenis Pengkodean: Detektor mengidentifikasi standar pengkodean Unicode yang digunakan - UTF-8, UTF-16 (dengan endianness), UTF-32 (dengan endianness), atau pengkodean Unicode lama lainnya seperti UTF-7, SCSU, atau BOCU-1.
  • Endianness: Untuk pengkodean multi-byte seperti UTF-16 dan UTF-32, detektor menentukan apakah byte berada dalam urutan big-endian (urutan jaringan) atau little-endian, yang sangat penting untuk interpretasi data teks yang benar.
  • Urutan Hex: Urutan byte heksadesimal yang tepat dari BOM yang terdeteksi ditampilkan di samping hex dump visual dari 16 byte pertama, dengan byte BOM disorot untuk memudahkan identifikasi.
  • Analisis Tingkat Byte: Detektor menampilkan representasi heksadesimal dan ASCII mentah dari byte pembuka file, membantu Anda memahami struktur biner terlepas dari apakah ada BOM.

Privasi, Keamanan & Praktik Terbaik

Privasi Anda adalah yang terpenting. Detektor BOM kami melakukan semua analisis sepenuhnya dalam browser Anda menggunakan JavaScript - tidak ada data file yang diunggah ke server mana pun, dan tidak ada data yang keluar dari perangkat Anda. Hal ini memastikan dokumen sensitif dan data hak milik tetap sepenuhnya rahasia. Detektor ini 100% gratis tanpa batasan ukuran file (hanya 16 byte pertama yang dibaca untuk dianalisis). Perhatikan bahwa meskipun BOM membantu mengidentifikasi pengkodean, tidak semua file memilikinya - banyak file UTF-8, terutama pada sistem Unix/Linux, sengaja menghilangkan BOM. Alat dan skrip harus menangani file BOM dan tanpa BOM dengan baik untuk kompatibilitas maksimum di seluruh platform.

Pertanyaan yang Sering Diajukan

Tanda Urutan Byte (BOM) adalah karakter Unicode (U+FEFF) yang ditempatkan di awal file teks atau aliran untuk menunjukkan jenis pengkodean dan urutan byte. Ini bertindak sebagai tanda tangan file yang membantu perangkat lunak menafsirkan dengan benar pengkodean data teks yang mengikuti urutan BOM.

Urutan hex EF BB BF adalah UTF-8 BOM. Biasanya ditambahkan oleh aplikasi Windows seperti Notepad saat menyimpan file sebagai UTF-8. Meskipun UTF-8 tidak memiliki endianness, BOM ini mengidentifikasi file sebagai berkode UTF-8. Banyak alat Unix dan Linux tidak mengharapkan BOM ini dan mungkin gagal menguraikan file dengan benar.

BOM dapat dihapus menggunakan hex editor, dengan menyimpan kembali file dengan "Simpan sebagai UTF-8 tanpa BOM" di editor teks Anda, atau menggunakan alat baris perintah. BOM hanyalah beberapa byte pertama dari file - menghapusnya akan membuat sisa konten file tetap utuh dan dapat dibaca.

Kehadiran BOM bergantung pada aplikasi dan platform yang membuat file tersebut. Aplikasi Windows seperti Notepad dan Microsoft Office biasanya menambahkan BOM ke file UTF-8. Alat Unix/Linux dan editor kode modern seperti VS Code biasanya menyimpan file tanpa BOM secara default untuk kompatibilitas maksimum.

Detektor BOM kami mendukung semua tanda tangan BOM yang dikenal: UTF-8 (EF BB BF), UTF-16 Big Endian (FE FF), UTF-16 Little Endian (FF FE), UTF-32 Big Endian (00 00 FE FF), UTF-32 Little Endian (FF FE 00 00), UTF-7 (2B 2F 76 38 dan variannya), UTF-1 (F7 64 4C), SCSU (0E FE FF), BOCU-1 (FB EE 28), dan GB-18030 (84 31 95 33).

Sangat. Detektor BOM kami memproses semuanya secara lokal di browser Anda. File dan teks Anda tidak pernah diunggah ke server mana pun - semua analisis terjadi di perangkat Anda, memastikan privasi dan keamanan data Anda sepenuhnya.

Endianness mengacu pada urutan penyusunan byte dalam tipe data multi-byte. Big-endian menyimpan byte paling signifikan terlebih dahulu, sedangkan little-endian menyimpan byte paling tidak signifikan terlebih dahulu. Untuk pengkodean UTF-16 dan UTF-32, mengetahui endianness sangat penting untuk memecahkan kode teks dengan benar. BOM memberi tahu perangkat lunak urutan byte mana yang akan digunakan.

Ya. BOM UTF-8 di awal file skrip (skrip shell, Python, JavaScript, PHP) dapat menyebabkan kesalahan sintaksis, keluaran yang tidak terduga, atau kegagalan "shebang" karena byte BOM muncul sebelum penanda !# atau <?php. Banyak kompiler dan juru bahasa tidak mengharapkan atau mengabaikan byte BOM.

Tidak, tidak ada batasan ukuran file praktis. Detektor BOM kami hanya membaca 16 byte pertama file apa pun untuk melakukan deteksi, sehingga file multi-gigabyte pun dapat dianalisis secara instan tanpa menghabiskan banyak memori atau bandwidth.