Conversor de codificação
Converta texto entre codificações de mais de 35 caracteres - incluindo UTF-8, UTF-16, famílias ISO-8859, páginas de código do Windows, KOI8-R/U, Shift-JIS, EUC-JP, GBK, Big5, EUC-KR, MacRoman, IBM437/850/866 e muito mais. Cole texto ou carregue um arquivo para transcodificar entre duas codificações quaisquer. Navegue por categoria de idioma, troque direções e baixe resultados - todo o processamento é executado localmente em seu navegador, sem uploads, sem inscrição, totalmente gratuito.
Convert text between 35+ character encodings - Unicode, Western European, Cyrillic, Japanese, Chinese, Korean, Arabic, Hebrew, Greek, and more. Paste text, upload a file, or choose sample text to get started. All processing is local in your browser.
Sample Text (click to load & convert)
Por que usar nosso conversor de codificação?
- Mais de 35 codificações de caracteres suportadas: O conversor de codificação suporta mais de 35 codificações de caracteres diferentes em 14 categorias - Unicode (UTF-8, UTF-16), Europa Ocidental (ISO-8859-1, Windows-1252), cirílico (KOI8-R, Windows-1251), japonês (Shift-JIS, EUC-JP), chinês (GBK, Big5), coreano (EUC-KR), árabe, hebraico, grego, Tailandês, vietnamita e muito mais. Converta entre quaisquer duas codificações com um único clique.
- Conversão bidirecional com navegação por categoria: converta texto entre qualquer par de codificações suportadas em ambas as direções. Procure codificações organizadas por categoria de idioma - páginas de código Unicode, ocidental, cirílico, asiático e DOS legado. Cada codificação inclui aliases (por exemplo, "latin1", "cp1252", "sjis") e uma breve descrição de seu uso e região.
- Detecção inteligente de fonte e resultados instantâneos: cole texto, carregue um arquivo ou insira bytes hexadecimais brutos para converter. A ferramenta mostra a saída original e convertida lado a lado com uma etiqueta clara. O texto de amostra integrado permite testar imediatamente as conversões entre qualquer par de codificação para verificar a exatidão antes de usar seus próprios dados.
- Processamento 100% privado baseado em navegador: todas as conversões de codificação são executadas inteiramente em seu navegador usando as APIs nativas TextEncoder e TextDecoder. Seu texto e arquivos nunca são enviados para nenhum servidor - eles permanecem no seu dispositivo para total privacidade. Sem inscrição, sem contas, sem limites de uso e sem registro de dados. Completamente grátis para sempre.
Casos de uso comuns para conversor de codificação
- Migração de banco de dados legado: ao migrar bancos de dados legados contendo texto codificado Windows-1252, ISO-8859-1 ou Shift-JIS para armazenamento UTF-8 moderno, use o Conversor de Codificação para transcodificar os dados exportados. Isso garante que caracteres acentuados, ideogramas CJK e símbolos especiais sejam preservados corretamente no novo banco de dados sem corrupção do mojibake.
- Localização multilíngue de sites: os engenheiros de localização usam o Conversor de codificação para traduzir o conteúdo do site entre diferentes codificações de caracteres. Converta conteúdo russo de KOI8-R para UTF-8, japonês de Shift-JIS para UTF-8 ou chinês de GBK para Big5 para o público chinês tradicional - garantindo que o texto seja renderizado corretamente em todos os navegadores e dispositivos.
- Recuperação de Documentos Legados: Abra documentos legados salvos com páginas de código DOS (IBM437, IBM850), MacRoman ou páginas de código regionais do Windows em aplicativos modernos. Primeiro converta o texto para UTF-8 usando a codificação de origem correta e depois salve-o em um formato Unicode moderno. Isso é essencial para acessar documentos históricos, e-mails arquivados e arquivos de software antigos.
- Depuração de Mojibake e corrupção de texto: quando o texto é exibido como caracteres distorcidos - como "É" em vez de "é" ou " " em vez de "文字" - use o Conversor de codificação para consertar. Ao converter da codificação real (geralmente detectada pela ferramenta Text Encoding Detector) para UTF-8, você pode recuperar o texto original e eliminar o mojibake em seus aplicativos.
- Processamento de dados em vários idiomas: cientistas e analistas de dados que processam conjuntos de dados multilíngues geralmente encontram arquivos em codificações diferentes. O Encoding Converter permite normalizar todo o texto para UTF-8 antes de executar pipelines de PNL, análise de sentimento ou classificação de texto. A codificação consistente evita a perda de dados e garante o processamento preciso de texto em idiomas e scripts.
- Sistemas incorporados e manipulação de texto IoT: desenvolvedores incorporados que trabalham com dispositivos que geram texto em codificações específicas (como ISO-8859-1 para coordenadas GPS ou Windows-1252 para leitores de código de barras) usam o conversor de codificação para transformar a saída do dispositivo em UTF-8 para integração na nuvem, visualização de painel ou exibição de aplicativo móvel.
O que é conversão de codificação?
A conversão de codificação é o processo de transformar texto de uma codificação de caracteres para outra. Cada codificação de caracteres mapeia caracteres para sequências de bytes específicas - UTF-8 usa codificação de comprimento variável para todos os caracteres Unicode, Windows-1252 usa bytes únicos para caracteres da Europa Ocidental e Shift-JIS usa uma mistura de bytes simples e duplos para texto em japonês. Quando um aplicativo interpreta bytes usando a codificação errada, o resultado é um texto ilegível conhecido como mojibake. O Conversor de Codificação traduz texto entre duas das mais de 35 codificações suportadas, preservando os caracteres originais.
Como funciona nosso conversor de codificação
- Selecionar codificações - Escolha a codificação de origem (a codificação em que seu texto está atualmente) e a codificação de destino (a codificação para a qual você deseja converter). Navegue por categoria - Unicode, Ocidental, Cirílico, Japonês, Chinês, Coreano e muito mais - ou pesquise por nome de codificação ou alias.
- Fornecer entrada - cole o texto diretamente, carregue um arquivo de texto ou escolha um texto de amostra pré-carregado. A ferramenta lê sua entrada e a interpreta usando a codificação de origem selecionada, convertendo-a para a representação Unicode interna.
- Converter e copiar – A ferramenta recodifica o texto Unicode na codificação de destino e exibe o resultado. Copie o texto convertido para a área de transferência ou baixe-o como um arquivo UTF-8 para uso em seu aplicativo, banco de dados ou fluxo de trabalho.
Categorias de codificação explicadas
- Codificações Unicode (UTF-8, UTF-16): O padrão moderno. UTF-8 é a codificação dominante na web (>98% das páginas), em aplicativos modernos e em JSON, XML, HTML e na maioria das APIs. UTF-16 é usado nativamente por Java, JavaScript, .NET e Windows. A conversão para UTF-8 é o destino recomendado para máxima compatibilidade.
- Europa Ocidental e Central (ISO-8859-1, Windows-1252, MacRoman): Codificações de byte único cobrindo a maioria dos idiomas europeus. Windows-1252 é a codificação herdada mais comum do Windows e é um superconjunto de ISO-8859-1 com caracteres imprimíveis adicionais no intervalo 0x80-0x9F.
- Codificações cirílicas (KOI8-R, Windows-1251, IBM866): KOI8-R é comum em Unix/Linux para texto russo. Windows-1251 é a codificação cirílica padrão do Windows. IBM866 é usado em sistemas DOS legados. A conversão de texto russo legado para UTF-8 garante compatibilidade em todas as plataformas.
- Codificações asiáticas (Shift-JIS, EUC-JP, GBK, Big5, EUC-KR): codificações multibyte para scripts japoneses, chineses e coreanos. Shift-JIS é o padrão japonês do Windows. GBK/GB2312 são para chinês simplificado. Big5 é para chinês tradicional. EUC-KR é para coreano. A conversão para UTF-8 é essencial para misturar texto asiático e latino.
Garantia de privacidade e processamento local
O Encoding Converter processa todos os dados inteiramente em seu navegador usando as APIs Web TextEncoder e TextDecoder nativas. Seu texto e arquivos nunca são carregados em nenhum servidor - eles são lidos usando a API FileReader e processados localmente em seu dispositivo. Não há requisitos de inscrição, limites de uso, recursos premium e registro de dados. A ferramenta é totalmente gratuita para qualquer finalidade – conversão de texto legado, correção de mojibake ou normalização de codificações para processamento de dados.
Perguntas frequentes
Um conversor de codificação transforma texto de uma codificação de caracteres para outra. As codificações de caracteres definem como os caracteres são representados como bytes - por exemplo, UTF-8, Windows-1252 e Shift-JIS representam o mesmo texto de maneira diferente no nível de byte. A conversão entre codificações é essencial ao trabalhar com dados legados, texto internacional ou sistemas que esperam uma codificação específica. Nossa ferramenta suporta mais de 35 codificações em 14 categorias de idiomas.
O conversor de codificação suporta codificações de mais de 35 caracteres: UTF-8, UTF-16LE, UTF-16BE, ISO-8859-1 a ISO-8859-11 e 15, Windows-1250 a Windows-1258, KOI8-R, KOI8-U, IBM437, IBM850, IBM866, MacRoman, Shift-JIS, EUC-JP, ISO-2022-JP, GBK, GB2312, GB18030, Big5, EUC-KR e muito mais. Cada codificação inclui seus aliases e uma descrição de seu uso.
Selecione a codificação de origem (em que seu texto está atualmente) e a codificação de destino (para a qual você deseja converter). Cole seu texto ou carregue um arquivo, clique em “Converter” e a ferramenta transcodificará o texto. Você também pode usar os botões "Texto de amostra" para testar instantaneamente cenários de conversão comuns, como Europa Ocidental para UTF-8 ou KOI8-R russo para UTF-8.
Sim. Mude para a guia “Carregar arquivo”, selecione um arquivo de texto do seu dispositivo (até 1 MB) e a ferramenta lê seu conteúdo usando a API FileReader. Todo o processamento é estritamente local - o arquivo nunca sai do seu dispositivo. Após a conversão, você pode copiar o resultado ou baixá-lo como um arquivo de texto UTF-8.
Quando um caractere existe no texto de origem, mas não na codificação de destino (por exemplo, convertendo caracteres japoneses para ISO-8859-1), o navegador o substitui por um caractere substituto - normalmente "?" ou o caractere de substituição Unicode (U+FFFD). A ferramenta exibe um aviso de conversão com perdas quando isso ocorre. Para preservação completa dos caracteres, sempre use UTF-8 como codificação de destino.
ISO-8859-1 e Windows-1252 são idênticos para os bytes 0xA0-0xFF, mas diferem no intervalo 0x80-0x9F. Na ISO-8859-1, esses bytes são caracteres de controle C1. No Windows-1252, eles são mapeados para caracteres imprimíveis, como aspas inteligentes (\u201c\u201d), o sinal do Euro (\u20ac), marca registrada (\u2122), marcador (\u2022) e travessões. Para conteúdo prático da web, o Windows-1252 é muito mais comum.
Sim - 100% grátis, para sempre. Sem inscrição, sem conta, sem nível premium, sem limites de uso e sem anúncios. Converta quanto texto precisar entre qualquer uma das mais de 35 codificações suportadas. Todo o processamento é feito localmente no seu navegador, sem nenhum upload no servidor, garantindo total privacidade.
Sim. Clique no botão de troca (duas setas verticais) entre os seletores de codificação de origem e de destino para reverter instantaneamente a direção da conversão. Isso é útil para testes de ida e volta - converter de UTF-8 para Windows-1252, trocar e converter novamente para verificar se o texto original foi preservado.