Детектор и исправление модзибаке
Находите и исправляйте модзибаке (искажённый текст из-за несовпадения кодировок) онлайн и бесплатно. Вставьте повреждённый текст, чтобы определить, какое несовпадение кодировок вызвало проблему: UTF-8, прочитанный как Latin-1, типографские кавычки Windows-1252, повреждение кириллического текста или проблемы кодировки CJK. Наш детектор модзибаке анализирует текст и показывает неправильную кодировку, правильную кодировку и количество найденных повреждённых символов. Одним кликом исправление модзибаке автоматически восстанавливает текст, переинтерпретируя байты с правильной кодировкой. Вся обработка полностью локальна в вашем браузере - данные не загружаются, регистрация не требуется.
Detect and fix mojibake (garbled text from encoding mismatches). Paste text corrupted by encoding issues to analyze what went wrong and repair it. All processing happens locally in your browser - no data is uploaded to any server.
- Paste garbled text (mojibake) into the left panel, or click a sample button above.
- Click Analyze Encoding to detect what encoding mismatch caused the corruption.
- Click Fix Mojibake to automatically repair the text using the detected patterns.
- Copy or download the fixed text from the right panel.
Зачем использовать наш детектор и исправление модзибаке?
- Умное обнаружение модзибаке: находите модзибаке в любом тексте с помощью распознавания шаблонов и эвристик кодировок. Наш детектор модзибаке определяет неправильно использованную кодировку и предлагает правильную - будь то UTF-8, прочитанный как Latin-1, типографские кавычки Windows-1252, кириллическое модзибаке или повреждение текста CJK.
- Исправление одним кликом: исправляйте модзибаке мгновенно одним кликом. Наше исправление модзибаке автоматически применяет правильную интерпретацию кодировки для восстановления текста - работает с UTF-8, Latin-1, Windows-1252 и сценариями двойного кодирования. Без ручного подбора.
- Исправление модзибаке онлайн - без установки: используйте наш детектор и исправление модзибаке прямо в любом браузере без загрузок, расширений и приложений. Вся обработка текста происходит локально на устройстве - без загрузок, без серверной обработки, полная приватность.
- 100 % бесплатно навсегда: наш детектор и исправление модзибаке полностью бесплатны: без регистрации, без рекламы и без ограничений использования. Обнаруживайте и исправляйте повреждение кодировок в любом количестве текстов - совершенно бесплатно навсегда. Вся обработка локальна и приватна.
Типичные сценарии использования детектора и исправления модзибаке
- Восстановление экспорта баз данных: восстанавливайте текст из экспортов баз данных, где кодировка была настроена неверно при извлечении. Наше исправление модзибаке обрабатывает частый сценарий, когда содержимое базы в UTF-8 экспортировалось с неправильной кодировкой, восстанавливая имена, адреса и многоязычный контент.
- Миграция сайтов и CMS: исправляйте искажённый контент при миграции сайтов, когда старая база использовала иную кодировку, чем ожидает CMS. Наш детектор модзибаке выявляет несовпадения в перенесённых записях, заголовках и метаданных.
- Восстановление документов и писем: восстанавливайте текст из повреждённых документов, писем и текстовых файлов, которые отображаются как абракадабра из-за проблем с кодировкой. Наше исправление модзибаке возвращает диакритические символы, кириллический текст и символы CJK в читаемый вид.
- Локализация ПО и i18n: отлаживайте проблемы кодировки в интернационализированном ПО и файлах локализации. Наш детектор модзибаке помогает разработчикам понять, почему переведённые строки отображаются повреждёнными в приложениях.
- Отладка API и конвейеров данных: устраняйте повреждение кодировок в ответах API и конвейерах обработки данных. Наше исправление модзибаке помогает разработчикам быстро выявлять и устранять несовпадения кодировок текста между системами.
- Обучение и образование: поймите, как работает кодирование текста, на реальных примерах модзибаке. Наш детектор модзибаке - отличный учебный инструмент для изучения UTF-8, Latin-1, Windows-1252 и того, как несовпадения кодировок искажают текст.
Что такое модзибаке?
Модзибаке (文字化け - буквально «трансформация символов» по-японски) - это искажённый текст, возникающий, когда строка декодируется с неправильной кодировкой символов. Это происходит, когда система или приложение интерпретирует байты текста в кодировке, отличной от той, что использовалась при их создании. Например, байты UTF-8 французского слова «déjà vu» ( 64 C3 A9 6A C3 A0 20 76 75 ) отобразились бы как «déjà vu» при чтении в Latin-1 (ISO 8859-1). Наш детектор модзибаке выявляет такие шаблоны, находя известные байтовые последовательности, возникающие из частых несовпадений кодировок, а затем исправление модзибаке обращает повреждение, переинтерпретируя байты с правильной кодировкой.
Как использовать этот детектор и исправление модзибаке
- 1. Вставьте повреждённый текст: скопируйте искажённый текст и вставьте его в левую панель или нажмите одну из кнопок примеров, чтобы попробовать типичные случаи модзибаке (французский, испанский, немецкий, русский, китайский, типографские кавычки).
- 2. Нажмите «Анализ кодировки»: наш детектор модзибаке сканирует текст на известные шаблоны повреждения и сообщает, какая кодировка, вероятно, использовалась для декодирования, какая должна была использоваться и сколько повреждённых символов найдено.
- 3. Нажмите «Исправить модзибаке»: наше исправление модзибаке автоматически переинтерпретирует байты с правильной кодировкой, восстанавливая исходный текст. Затем вы можете скопировать или скачать исправленный результат.
Типичные сценарии модзибаке
- UTF-8 → Latin-1 / Windows-1252: самый частый сценарий. Диакритические символы вроде é, ü, ñ превращаются в двухсимвольные последовательности é, ü, ñ. Кириллический текст становится нечитаемыми последовательностями, начинающимися с Ð. Символы CJK превращаются в последовательности, начинающиеся с ä, æ и т. д.
- UTF-8 → Windows-1252 (типографские кавычки): закодированные в UTF-8 фигурные кавычки, длинные тире и маркеры отображаются как ’, “, — и т. д. Часто встречается в контенте, скопированном из текстовых редакторов или веб-страниц.
- Двойное кодирование UTF-8: когда текст UTF-8 случайно кодируется в UTF-8 второй раз. Байты é (0xC3 0xA9) перекодируются в 4-байтовую последовательность 0xC3 0x83 0xC2 0xA9 и отображаются как é.
- Проблемы с BOM UTF-8: метка порядка байтов UTF-8 (0xEF BB BF), отображаемая как видимые символы «ï»¿» в начале файла при чтении с неправильной кодировкой.
Ограничения обнаружения модзибаке
Хотя наш детектор модзибаке обрабатывает самые частые сценарии несовпадения кодировок, есть ограничения, о которых стоит знать. Детектор использует сопоставление с известными сигнатурами модзибаке, поэтому может не распознать любое возможное повреждение кодировки - особенно с редкими парами (например, UTF-8, декодированный как Shift-JIS или KOI8-R). Короткие тексты (меньше 10 символов) могут не содержать достаточно повреждённого контента для надёжной детекции. Оценка уверенности отражает число совпавших известных шаблонов; результат с низкой уверенностью всё ещё может содержать нераспознанное модзибаке. Для лучших результатов попробуйте действие «Исправить модзибаке», даже если детектор не показывает проблем: исправление применяет более агрессивную стратегию, способную исправить шаблоны, которые детектор мог пропустить. Вся обработка текста в этом детекторе и исправлении модзибаке выполняется полностью в вашем браузере - никакие данные не загружаются на сервер и никакой текст не покидает устройство.
Часто задаваемые вопросы
Модзибаке (文字化け) - это искажённый текст, который появляется, когда строка декодируется с неправильной кодировкой символов. Например, когда текст в UTF-8 с диакритическими символами интерпретируется как Latin-1, символы вроде é отображаются как «Ã©». Наш детектор модзибаке выявляет такие шаблоны, а исправление обращает повреждение.
Наш детектор модзибаке сканирует входной текст на известные шаблоны повреждения - конкретные байтовые последовательности, возникающие из частых несовпадений кодировок. Он проверяет UTF-8→Latin-1, UTF-8→Windows-1252, двойное кодирование UTF-8, кириллическое модзибаке, модзибаке CJK и артефакты BOM. Каждый шаблон сопоставляется с вероятной неправильной и правильной парой кодировок с оценкой уверенности.
Исправление модзибаке применяет обратное к обнаруженному несовпадению. Для самого частого сценария (текст UTF-8, прочитанный как Latin-1) оно берёт искажённые символы, кодирует их обратно в байты Latin-1, а затем декодирует эти байты как UTF-8. Так восстанавливается исходный текст. Если одного прохода недостаточно, исправление также пробует двойное декодирование.
Наш детектор и исправление модзибаке в основном обрабатывает несовпадения UTF-8↔Latin-1 (ISO 8859-1) и UTF-8↔Windows-1252, которые составляют подавляющее большинство случаев модзибаке на практике. Также обнаруживаются двойное кодирование UTF-8 и артефакты BOM UTF-8. Для более редких пар текст может быть не полностью восстановим.
Да. Наше исправление модзибаке обрабатывает текст любой длины. Вся обработка идёт локально в браузере, так что единственное ограничение - память вашего устройства. Для очень больших документов (свыше 100 000 символов) обработка может занять мгновение, но завершится без загрузки данных.
Для самого частого сценария (текст UTF-8, прочитанный как Latin-1 или Windows-1252) детекция очень точна - обычно 90 % и выше при наличии нескольких диакритических или не-ASCII символов. Для более редких шаблонов или очень коротких текстов точность снижается. Оценка уверенности и подробная разбивка проблем помогают оценить надёжность детекции.
Безусловно. Наш детектор и исправление модзибаке обрабатывают всё полностью в вашем браузере. Ваш текст никогда не загружается на сервер, не хранится и никуда не отправляется. Вся детекция, анализ и восстановление происходят локально на устройстве через клиентский JavaScript. Полная приватность заложена в инструмент по дизайну.
«Анализ кодировки» обнаруживает шаблоны модзибаке и показывает вероятное несовпадение кодировок, вызвавшее повреждение, но не изменяет входной текст. «Исправить модзибаке» применяет алгоритм восстановления и создаёт исправленный текст в панели вывода. Используйте «Анализ», чтобы понять проблему, а затем «Исправить», чтобы получить восстановленный результат.
Да! Наш детектор и исправление модзибаке на 100 % бесплатны: без регистрации, без рекламы и без ограничений использования. Обнаруживайте и исправляйте повреждение кодировок в любом количестве текстов - совершенно бесплатно навсегда. Вся обработка происходит локально в браузере без взаимодействия с сервером.