Конвертер кодировок
Преобразуйте текст в более чем 35 кодировок символов, включая семейства UTF-8, UTF-16, ISO-8859, кодовые страницы Windows, KOI8-R/U, Shift-JIS, EUC-JP, GBK, Big5, EUC-KR, MacRoman, IBM437/850/866 и другие. Вставьте текст или загрузите файл для перекодирования между любыми двумя кодировками. Просматривайте языковые категории, меняйте направления и результаты загрузки — вся обработка выполняется локально в вашем браузере, без загрузки и регистрации, совершенно бесплатно.
Convert text between 35+ character encodings - Unicode, Western European, Cyrillic, Japanese, Chinese, Korean, Arabic, Hebrew, Greek, and more. Paste text, upload a file, or choose sample text to get started. All processing is local in your browser.
Sample Text (click to load & convert)
Зачем использовать наш конвертер кодировок?
- Поддерживается более 35 кодировок символов: конвертер кодировок поддерживает более 35 различных кодировок символов в 14 категориях: Юникод (UTF-8, UTF-16), западноевропейский (ISO-8859-1, Windows-1252), кириллица (KOI8-R, Windows-1251), японский (Shift-JIS, EUC-JP), китайский (GBK, Big5), корейский (EUC-KR), арабский, иврит, греческий, Тайский, вьетнамский и другие. Преобразование между любыми двумя кодировками одним щелчком мыши.
- Двунаправленное преобразование с просмотром категорий: конвертируйте текст между любой парой поддерживаемых кодировок в обоих направлениях. Просмотрите кодировки, упорядоченные по языковым категориям: кодовые страницы Unicode, Western, Cyrillic, Asian и устаревшие кодовые страницы DOS. Каждая кодировка включает псевдонимы (например, «latin1», «cp1252», «sjis») и краткое описание ее использования и региона.
- Интеллектуальное обнаружение источника и мгновенные результаты: вставьте текст, загрузите файл или введите необработанные шестнадцатеричные байты для преобразования. Инструмент показывает как исходный, так и преобразованный результат рядом с четкой маркировкой. Встроенный образец текста позволяет немедленно протестировать преобразования между любой парой кодировок, чтобы убедиться в правильности перед использованием собственных данных.
- 100% частная обработка на основе браузера: все преобразования кодировок выполняются полностью в вашем браузере с использованием собственных API-интерфейсов TextEncoder и TextDecoder. Ваш текст и файлы никогда не загружаются на какой-либо сервер — они остаются на вашем устройстве для обеспечения полной конфиденциальности. Никакой регистрации, никаких учетных записей, никаких ограничений на использование и никакой регистрации данных. Полностью бесплатно навсегда.
Распространенные случаи использования конвертера кодировок
- Миграция устаревших баз данных. При переносе устаревших баз данных, содержащих текст в кодировке Windows-1252, ISO-8859-1 или Shift-JIS, в современное хранилище UTF-8, используйте конвертер кодировки для перекодирования экспортированных данных. Это гарантирует, что символы с диакритическими знаками, иероглифы CJK и специальные символы будут правильно сохранены в новой базе данных без повреждения моджибаке.
- Многоязычная локализация веб-сайтов. Инженеры по локализации используют конвертер кодировок для перевода содержимого веб-сайта между различными кодировками символов. Преобразуйте русский контент из KOI8-R в UTF-8, японский — из Shift-JIS в UTF-8 или китайский — из GBK в Big5 для традиционной китайской аудитории — гарантируя правильное отображение текста во всех браузерах и устройствах.
- Восстановление устаревших документов: открывайте устаревшие документы, сохраненные с кодовыми страницами DOS (IBM437, IBM850), MacRoman или региональными кодовыми страницами Windows, в современных приложениях. Сначала преобразуйте текст в UTF-8, используя правильную исходную кодировку, а затем сохраните его в современном формате Unicode. Это важно для доступа к историческим документам, архивным электронным письмам и устаревшим файлам программного обеспечения.
- Отладка Mojibake и искажение текста: если текст отображается в виде искаженных символов, например «Ã©» вместо «é» или « » вместо «文字», используйте конвертер кодировки, чтобы исправить это. Преобразовав фактическую кодировку (часто определяемую инструментом «Детектор кодировки текста») в UTF-8, вы можете восстановить исходный текст и исключить моджибаке в своих приложениях.
- Межъязыковая обработка данных. Специалисты по данным и аналитики, обрабатывающие многоязычные наборы данных, часто сталкиваются с файлами в разных кодировках. Конвертер кодировки позволяет нормализовать весь текст в UTF-8 перед запуском конвейеров NLP, анализа настроений или классификации текста. Согласованное кодирование предотвращает потерю данных и обеспечивает точную обработку текста на разных языках и алфавитах.
- Встроенные системы и обработка текста в Интернете вещей. Разработчики встраиваемых систем, работающие с устройствами, которые выводят текст в определенных кодировках (например, ISO-8859-1 для координат GPS или Windows-1252 для считывателей штрих-кодов), используют конвертер кодировки для преобразования выходных данных устройства в UTF-8 для интеграции с облаком, визуализации информационной панели или отображения в мобильных приложениях.
Что такое преобразование кодировки?
Преобразование кодировки — это процесс преобразования текста из одной кодировки символов в другую. Каждая кодировка символов сопоставляет символы с определенными последовательностями байтов: UTF-8 использует кодировку переменной длины для всех символов Юникода, Windows-1252 использует одиночные байты для западноевропейских символов, а Shift-JIS использует сочетание одиночных и двойных байтов для японского текста. Когда приложение интерпретирует байты, используя неправильную кодировку, результатом является искаженный текст, известный как mojibake. Конвертер кодировок переводит текст между любыми двумя из более чем 35 поддерживаемых кодировок, сохраняя при этом исходные символы.
Как работает наш конвертер кодировок
- Выберите кодировки. Выберите исходную кодировку (кодировку, в которой сейчас находится ваш текст) и целевую кодировку (кодировку, в которую вы хотите преобразовать). Просмотр по категориям — Юникод, западная, кириллица, японский, китайский, корейский и другие — или поиск по названию или псевдониму кодировки.
- Предоставьте ввод: вставьте текст напрямую, загрузите текстовый файл или выберите текст из предварительно загруженного образца текста. Инструмент считывает введенные вами данные и интерпретирует их, используя выбранную исходную кодировку, преобразуя их во внутреннее представление Unicode.
- Конвертировать и копировать. Инструмент перекодирует текст Unicode в целевую кодировку и отображает результат. Скопируйте преобразованный текст в буфер обмена или загрузите его как файл UTF-8 для использования в своем приложении, базе данных или рабочем процессе.
Объяснение категорий кодирования
- Кодировки Unicode (UTF-8, UTF-16): современный стандарт. UTF-8 является доминирующей кодировкой в Интернете (>98% страниц), в современных приложениях, а также в JSON, XML, HTML и большинстве API. UTF-16 изначально используется Java, JavaScript, .NET и Windows. Преобразование в UTF-8 является рекомендуемой целью для обеспечения максимальной совместимости.
- Западная и Центральная Европа (ISO-8859-1, Windows-1252, MacRoman): однобайтовые кодировки, охватывающие большинство европейских языков. Windows-1252 — это наиболее распространенная устаревшая кодировка Windows, расширенная версия ISO-8859-1 с дополнительными печатными символами в диапазоне 0x80–0x9F.
- Кодировки кириллицы (KOI8-R, Windows-1251, IBM866): KOI8-R распространен в Unix/Linux для русского текста. Windows-1251 — стандартная кодировка кириллицы Windows. IBM866 используется в устаревших системах DOS. Преобразование устаревшего русского текста в UTF-8 обеспечивает совместимость на всех платформах.
- Азиатские кодировки (Shift-JIS, EUC-JP, GBK, Big5, EUC-KR): многобайтовые кодировки для японских, китайских и корейских скриптов. Shift-JIS — это японский стандарт Windows. GBK/GB2312 — упрощенный китайский. Big5 — традиционный китайский. EUC-KR — для корейского языка. Преобразование в UTF-8 необходимо для смешивания азиатского и латинского текста.
Гарантия конфиденциальности и локальной обработки
Конвертер кодировки обрабатывает все данные полностью в вашем браузере, используя собственные веб-API TextEncoder и TextDecoder. Ваш текст и файлы никогда не загружаются на какой-либо сервер — они читаются с помощью FileReader API и обрабатываются локально на вашем устройстве. Никаких требований к регистрации, ограничений на использование, дополнительных функций и регистрации данных нет. Инструмент полностью бесплатен для любых целей — преобразования устаревшего текста, исправления моджибаке или нормализации кодировок для обработки данных.
Часто задаваемые вопросы
Конвертер кодировки преобразует текст из одной кодировки символов в другую. Кодировки символов определяют, как символы представляются в виде байтов — например, UTF-8, Windows-1252 и Shift-JIS представляют один и тот же текст по-разному на уровне байтов. Преобразование между кодировками важно при работе с устаревшими данными, международным текстом или системами, которые ожидают определенную кодировку. Наш инструмент поддерживает более 35 кодировок в 14 языковых категориях.
Конвертер кодировок поддерживает более 35 кодировок символов: UTF-8, UTF-16LE, UTF-16BE, от ISO-8859-1 до ISO-8859-11 и 15, от Windows-1250 до Windows-1258, KOI8-R, KOI8-U, IBM437, IBM850, IBM866, MacRoman, Shift-JIS, EUC-JP, ISO-2022-JP, GBK, GB2312, GB18030, Big5, EUC-KR и другие. Каждая кодировка включает свои псевдонимы и описание ее использования.
Выберите исходную кодировку (в которой сейчас находится ваш текст) и целевую кодировку (во что вы хотите преобразовать). Вставьте свой текст или загрузите файл, нажмите «Конвертировать», и инструмент перекодирует текст. Вы также можете использовать кнопки «Пример текста», чтобы мгновенно протестировать распространенные сценарии преобразования, такие как западноевропейский в UTF-8 или русский KOI8-R в UTF-8.
Да. Перейдите на вкладку «Загрузить файл», выберите текстовый файл на вашем устройстве (до 1 МБ), и инструмент прочитает его содержимое с помощью FileReader API. Вся обработка строго локальная — файл никогда не покидает ваше устройство. После конвертации вы можете скопировать результат или загрузить его в виде текстового файла UTF-8.
Если символ существует в исходном тексте, но отсутствует в целевой кодировке (например, при преобразовании японских символов в ISO-8859-1), браузер заменяет его запасным символом — обычно «?» или символ замены Юникода (U+FFFD). В этом случае инструмент отображает предупреждение о преобразовании с потерями. Для полного сохранения символов всегда используйте UTF-8 в качестве целевой кодировки.
ISO-8859-1 и Windows-1252 идентичны для байтов 0xA0-0xFF, но различаются в диапазоне 0x80-0x9F. В ISO-8859-1 эти байты являются управляющими символами C1. В Windows-1252 они сопоставляются с печатными символами, такими как смарт-кавычки (\u201c\u201d), знак евро (\u20ac), товарный знак (\u2122), маркер (\u2022) и тире en/em. Для практического веб-контента гораздо чаще используется Windows-1252.
Да – 100% бесплатно, навсегда. Без регистрации, без учетной записи, без премиум-уровня, без ограничений на использование и без рекламы. Конвертируйте столько текста, сколько вам нужно, между любой из более чем 35 поддерживаемых кодировок. Вся обработка выполняется локально в вашем браузере без загрузки на сервер, что обеспечивает полную конфиденциальность.
Да. Нажмите кнопку переключения (две вертикальные стрелки) между селекторами исходной и целевой кодировки, чтобы мгновенно изменить направление преобразования. Это полезно для двустороннего тестирования — конвертируйте из UTF-8 в Windows-1252, поменяйте местами и преобразуйте обратно, чтобы убедиться, что исходный текст сохранен.