Détecteur et Correcteur de Mojibake
Détectez et corrigez le mojibake (texte illisible causé par des incohérences d'encodage) en ligne gratuitement. Collez le texte corrompu pour identifier quelle incohérence d'encodage a causé le problème - qu'il s'agisse d'UTF-8 lu comme du Latin-1, de guillemets typographiques Windows-1252, de corruption de texte cyrillique ou de problèmes d'encodage CJK. Notre détecteur de mojibake analyse le texte et vous indique le mauvais encodage, le bon encodage et le nombre de caractères corrompus détectés. En un clic, le correcteur de mojibake répare automatiquement le texte en réinterprétant les octets avec le bon encodage. Tout le traitement est entièrement local dans votre navigateur - aucune donnée n'est envoyée et aucune inscription n'est requise.
Detect and fix mojibake (garbled text from encoding mismatches). Paste text corrupted by encoding issues to analyze what went wrong and repair it. All processing happens locally in your browser - no data is uploaded to any server.
- Paste garbled text (mojibake) into the left panel, or click a sample button above.
- Click Analyze Encoding to detect what encoding mismatch caused the corruption.
- Click Fix Mojibake to automatically repair the text using the detected patterns.
- Copy or download the fixed text from the right panel.
Pourquoi utiliser notre détecteur et correcteur de mojibake ?
- Détection intelligente du mojibake : détectez le mojibake dans n'importe quel texte grâce à la reconnaissance de motifs et à des heuristiques d'encodage. Notre détecteur de mojibake identifie le mauvais encodage utilisé et suggère le bon - qu'il s'agisse d'UTF-8 lu comme du Latin-1, de guillemets typographiques Windows-1252, de mojibake cyrillique ou de corruption de texte CJK.
- Correction et réparation en un clic : corrigez le mojibake instantanément d'un seul clic. Notre correcteur de mojibake applique automatiquement la bonne interprétation d'encodage pour restaurer votre texte - gère UTF-8, Latin-1, Windows-1252 et les scénarios de double encodage. Aucun essai-erreur manuel nécessaire.
- Correcteur de mojibake en ligne - sans installation : utilisez notre détecteur et correcteur de mojibake directement dans n'importe quel navigateur, sans téléchargement, extension ni installation d'application. Tout le traitement du texte se fait localement sur votre appareil - aucun envoi, aucun traitement serveur, confidentialité totale.
- 100 % gratuit pour toujours : notre détecteur et correcteur de mojibake est entièrement gratuit, sans inscription, sans publicité et sans limite d'utilisation. Détectez et corrigez la corruption d'encodage dans autant de textes que nécessaire - entièrement gratuit, pour toujours. Tout le traitement est local et privé.
Cas d'usage courants du détecteur et correcteur de mojibake
- Récupération d'exportations de bases de données : réparez le texte d'exportations de bases de données où l'encodage a été mal configuré lors de l'extraction. Notre correcteur de mojibake gère le scénario courant où le contenu UTF-8 d'une base de données a été exporté avec le mauvais encodage, restaurant noms, adresses et contenus multilingues.
- Migration de sites web et de CMS : corrigez le contenu illisible lors de migrations web où l'ancienne base de données utilisait un encodage différent de celui attendu par le CMS. Notre détecteur de mojibake identifie les incohérences dans les articles, titres et métadonnées migrés.
- Réparation de documents et d'e-mails : récupérez du texte à partir de documents, e-mails et fichiers texte corrompus qui s'affichent en charabia à cause de problèmes d'encodage. Notre correcteur de mojibake restaure les caractères accentués, le texte cyrillique et les caractères CJK sous leur forme lisible.
- Localisation logicielle et i18n : déboguez les problèmes d'encodage dans les logiciels internationalisés et les fichiers de localisation. Notre détecteur de mojibake aide les développeurs à identifier pourquoi les chaînes traduites apparaissent corrompues dans leurs applications.
- Débogage d'API et de pipelines de données : résolvez la corruption d'encodage dans les réponses d'API et les pipelines de traitement de données. Notre correcteur de mojibake aide les développeurs à identifier et réparer rapidement les incohérences d'encodage de texte entre systèmes.
- Apprentissage et éducation : comprenez le fonctionnement de l'encodage de texte en voyant de vrais exemples de mojibake. Notre détecteur de mojibake est un excellent outil pédagogique pour apprendre UTF-8, Latin-1, Windows-1252 et la manière dont les incohérences d'encodage corrompent le texte.
Qu'est-ce que le mojibake ?
Le mojibake (文字化け - littéralement « transformation de caractères » en japonais) est le texte illisible qui apparaît lorsqu'une chaîne est décodée avec le mauvais encodage de caractères. Cela se produit lorsqu'un système ou une application interprète les octets du texte avec un encodage différent de celui utilisé pour les créer. Par exemple, les octets UTF-8 du mot français « déjà vu » ( 64 C3 A9 6A C3 A0 20 76 75 ) apparaîtraient sous la forme « déjà vu » s'ils sont lus en Latin-1 (ISO 8859-1). Notre détecteur de mojibake identifie ces motifs en recherchant des séquences d'octets connues résultant d'incohérences courantes, puis notre correcteur de mojibake inverse la corruption en réinterprétant les octets avec le bon encodage.
Comment utiliser ce détecteur et correcteur de mojibake
- 1. Collez le texte corrompu : copiez le texte illisible et collez-le dans le panneau de gauche, ou cliquez sur l'un des boutons d'exemple pour essayer des cas courants de mojibake (français, espagnol, allemand, russe, chinois, guillemets typographiques).
- 2. Cliquez sur « Analyser l'encodage » : notre détecteur de mojibake analyse le texte à la recherche de motifs de corruption connus et indique quel encodage a probablement servi à décoder le texte, quel encodage aurait dû être utilisé et combien de caractères corrompus ont été trouvés.
- 3. Cliquez sur « Corriger le mojibake » : notre correcteur de mojibake réinterprète automatiquement les octets avec le bon encodage, restaurant le texte d'origine. Vous pouvez ensuite copier ou télécharger le résultat corrigé.
Scénarios de mojibake courants
- UTF-8 → Latin-1 / Windows-1252 : le scénario le plus courant. Les caractères accentués comme é, ü, ñ deviennent les séquences de deux caractères é, ü, ñ. Le texte cyrillique devient des séquences illisibles commençant par Ð. Les caractères CJK deviennent des séquences commençant par ä, æ, etc.
- UTF-8 → Windows-1252 (guillemets typographiques) : les guillemets courbes, tirets cadratins et puces encodés en UTF-8 s'affichent sous la forme ’, “, —, etc. Fréquent dans le contenu copié depuis des traitements de texte ou des pages web.
- Double encodage UTF-8 : lorsqu'un texte UTF-8 est accidentellement encodé une seconde fois en UTF-8. Les octets de é (0xC3 0xA9) sont réencodés en la séquence de 4 octets 0xC3 0x83 0xC2 0xA9, s'affichant sous la forme é.
- Problèmes de BOM UTF-8 : le BOM UTF-8 (0xEF BB BF) affiché sous la forme des caractères visibles «  » au début d'un fichier lorsqu'il est lu avec le mauvais encodage.
Limites de la détection de mojibake
Bien que notre détecteur de mojibake gère les scénarios d'incohérence d'encodage les plus courants, il présente des limites à connaître. Le détecteur utilise la correspondance de motifs sur des signatures de mojibake connues, ce qui signifie qu'il peut ne pas reconnaître toute corruption d'encodage possible - en particulier avec des paires d'encodages rares (comme UTF-8 décodé en Shift-JIS ou KOI8-R). Les textes courts (moins de 10 caractères) peuvent ne pas contenir assez de contenu corrompu pour une détection fiable. L'indice de confiance reflète le nombre de motifs connus correspondants ; un résultat à faible confiance peut encore contenir du mojibake non reconnu. Pour de meilleurs résultats, essayez l'action « Corriger le mojibake » même si le détecteur ne signale aucun problème : le correcteur applique une stratégie de réparation plus agressive qui peut corriger des motifs que le détecteur pourrait manquer. Tout le traitement du texte dans ce détecteur et correcteur de mojibake est effectué entièrement dans votre navigateur - aucune donnée n'est envoyée à un serveur et aucun texte ne quitte votre appareil.
Foire aux questions
Le mojibake (文字化け) est le texte illisible qui apparaît lorsqu'une chaîne est décodée avec un mauvais encodage de caractères. Par exemple, lorsqu'un texte encodé en UTF-8 contenant des caractères accentués est interprété comme du Latin-1, des caractères comme é s'affichent sous la forme «Ã©». Notre détecteur de mojibake identifie ces motifs et notre correcteur inverse la corruption.
Notre détecteur de mojibake analyse le texte saisi à la recherche de motifs de corruption connus : des séquences d'octets spécifiques résultant d'incohérences d'encodage courantes. Il vérifie UTF-8→Latin-1, UTF-8→Windows-1252, le double encodage UTF-8, le mojibake cyrillique, le mojibake CJK et les artefacts BOM. Chaque motif est associé à la paire d'encodages probablement erroné et correct, avec un indice de confiance.
Le correcteur de mojibake applique l'inverse de l'incohérence détectée. Pour le scénario le plus courant (texte UTF-8 lu comme du Latin-1), il reprend les caractères corrompus, les réencode en octets Latin-1, puis décode ces octets en UTF-8. Cela restaure le texte d'origine. Le correcteur tente aussi un double décodage si une seule passe ne résout pas entièrement la corruption.
Notre détecteur et correcteur de mojibake traite principalement les incohérences UTF-8↔Latin-1 (ISO 8859-1) et UTF-8↔Windows-1252, qui représentent la grande majorité des cas de mojibake rencontrés en pratique. Il détecte aussi le double encodage UTF-8 et les artefacts BOM UTF-8. Pour les paires moins courantes, le texte peut ne pas être entièrement récupérable.
Oui. Notre correcteur de mojibake peut traiter un texte de n'importe quelle longueur. Tout le traitement se fait localement dans votre navigateur, la seule limite étant la mémoire de votre appareil. Pour de très gros documents (plus de 100 000 caractères), le traitement peut prendre un instant, mais s'achèvera sans qu'aucune donnée ne soit envoyée.
Pour le scénario le plus courant (texte UTF-8 lu comme du Latin-1 ou du Windows-1252), la détection est très précise - généralement 90 % ou plus lorsqu'il y a plusieurs caractères accentués ou non ASCII. Pour des motifs moins courants ou des textes très courts, la précision diminue. L'indice de confiance et le détail des problèmes vous aident à évaluer la fiabilité de la détection.
Absolument. Notre détecteur et correcteur de mojibake traite tout entièrement dans votre navigateur. Votre texte n'est jamais envoyé à un serveur, jamais stocké et jamais transmis où que ce soit. Toute la détection, l'analyse et la réparation se font localement sur votre appareil grâce à du JavaScript côté client. La confidentialité totale est intégrée à l'outil par conception.
« Analyser l'encodage » détecte les motifs de mojibake et vous indique l'incohérence d'encodage probablement responsable de la corruption, mais ne modifie pas votre texte saisi. « Corriger le mojibake » applique l'algorithme de réparation pour produire le texte corrigé dans le panneau de sortie. Utilisez « Analyser » pour comprendre le problème, puis « Corriger » pour obtenir le résultat réparé.
Oui ! Notre détecteur et correcteur de mojibake est 100 % gratuit, sans inscription, sans publicité et sans limite d'utilisation. Détectez et corrigez la corruption d'encodage dans autant de textes que nécessaire - entièrement gratuit, pour toujours. Tout le traitement se fait localement dans votre navigateur sans interaction avec un serveur.