Aller au contenu
Aback Tools Logo

Convertisseur d'encodage

Convertissez du texte entre plus de 35 encodages de caractères, notamment les familles UTF-8, UTF-16, ISO-8859, les pages de codes Windows, KOI8-R/U, Shift-JIS, EUC-JP, GBK, Big5, EUC-KR, MacRoman, IBM437/850/866, et plus encore. Collez du texte ou téléchargez un fichier à transcoder entre deux encodages quelconques. Parcourez par catégorie de langue, échangez des directions et téléchargez les résultats - tous les traitements s'exécutent localement dans votre navigateur, sans téléchargement, sans inscription, entièrement gratuits.

Encoding Converter

Convert text between 35+ character encodings - Unicode, Western European, Cyrillic, Japanese, Chinese, Korean, Arabic, Hebrew, Greek, and more. Paste text, upload a file, or choose sample text to get started. All processing is local in your browser.

0 chars

Sample Text (click to load & convert)

Pourquoi utiliser notre convertisseur d'encodage ?

  • Plus de 35 encodages de caractères pris en charge : le convertisseur d'encodage prend en charge plus de 35 encodages de caractères différents dans 14 catégories : Unicode (UTF-8, UTF-16), Europe occidentale (ISO-8859-1, Windows-1252), cyrillique (KOI8-R, Windows-1251), japonais (Shift-JIS, EUC-JP), chinois (GBK, Big5), coréen (EUC-KR), arabe, hébreu, grec, Thaï, vietnamien et plus encore. Convertissez entre deux encodages quelconques en un seul clic.
  • Conversion bidirectionnelle avec navigation par catégorie : convertissez le texte entre n'importe quelle paire d'encodages pris en charge dans les deux sens. Parcourez les encodages organisés par catégorie de langue : pages de codes Unicode, occidentales, cyrilliques, asiatiques et DOS héritées. Chaque codage comprend des alias (par exemple, « latin1 », « cp1252 », « sjis ») et une brève description de son utilisation et de sa région.
  • Détection intelligente de source et résultats instantanés : collez du texte, téléchargez un fichier ou saisissez des octets hexadécimaux bruts à convertir. L'outil affiche côte à côte la sortie originale et la sortie convertie avec un étiquetage clair. Un exemple de texte intégré vous permet de tester immédiatement les conversions entre n'importe quelle paire de codage pour vérifier l'exactitude avant d'utiliser vos propres données.
  • Traitement 100 % privé basé sur un navigateur : toutes les conversions d'encodage s'exécutent entièrement dans votre navigateur à l'aide des API natives TextEncoder et TextDecoder. Vos textes et fichiers ne sont jamais téléchargés sur aucun serveur - ils restent sur votre appareil pour une confidentialité totale. Pas d'inscription, pas de compte, pas de limite d'utilisation et pas d'enregistrement de données. Entièrement gratuit pour toujours.

Cas d'utilisation courants du convertisseur d'encodage

  • Migration de bases de données héritées : lors de la migration d'anciennes bases de données contenant du texte codé Windows-1252, ISO-8859-1 ou Shift-JIS vers un stockage UTF-8 moderne, utilisez le convertisseur d'encodage pour transcoder les données exportées. Cela garantit que les caractères accentués, les idéogrammes CJK et les symboles spéciaux sont correctement conservés dans la nouvelle base de données sans corruption mojibake.
  • Localisation de sites Web multilingues : les ingénieurs de localisation utilisent Encoding Converter pour traduire le contenu d'un site Web entre différents encodages de caractères. Convertissez le contenu russe de KOI8-R en UTF-8, japonais de Shift-JIS en UTF-8 ou chinois de GBK en Big5 pour le public chinois traditionnel, garantissant ainsi un rendu correct du texte sur tous les navigateurs et appareils.
  • Récupération de documents hérités : ouvrez des documents hérités enregistrés avec des pages de codes DOS (IBM437, IBM850), MacRoman ou des pages de codes Windows régionales dans des applications modernes. Convertissez d’abord le texte en UTF-8 en utilisant le codage source correct, puis enregistrez-le dans un format Unicode moderne. Ceci est essentiel pour accéder aux documents historiques, aux e-mails archivés et aux fichiers de logiciels anciens.
  • Débogage de Mojibake et de la corruption de texte : lorsque le texte s'affiche sous forme de caractères tronqués - comme "é" au lieu de "é" ou " " au lieu de "文字" - utilisez le convertisseur d'encodage pour le corriger. En convertissant l'encodage réel (souvent détecté par l'outil Text Encoding Detector) en UTF-8, vous pouvez récupérer le texte original et éliminer mojibake dans vos applications.
  • Traitement des données multilingues : les data scientists et les analystes traitant des ensembles de données multilingues rencontrent souvent des fichiers dans des encodages différents. Le convertisseur d'encodage vous permet de normaliser tout le texte au format UTF-8 avant d'exécuter des pipelines NLP, une analyse des sentiments ou une classification de texte. Un codage cohérent évite la perte de données et garantit un traitement de texte précis dans toutes les langues et tous les scripts.
  • Systèmes embarqués et gestion du texte IoT : les développeurs embarqués travaillant avec des appareils qui génèrent du texte dans des encodages spécifiques (comme ISO-8859-1 pour les coordonnées GPS ou Windows-1252 pour les lecteurs de codes-barres) utilisent le convertisseur d'encodage pour transformer la sortie de l'appareil en UTF-8 pour l'intégration dans le cloud, la visualisation de tableaux de bord ou l'affichage d'applications mobiles.

Qu’est-ce que la conversion d’encodage ?

La conversion d'encodage est le processus de transformation du texte d'un encodage de caractères à un autre. Chaque codage de caractères mappe les caractères à des séquences d'octets spécifiques : UTF-8 utilise un codage de longueur variable pour tous les caractères Unicode, Windows-1252 utilise des octets simples pour les caractères d'Europe occidentale et Shift-JIS utilise un mélange d'octets simples et doubles pour le texte japonais. Lorsqu'une application interprète des octets en utilisant un codage incorrect, le résultat est un texte tronqué appelé mojibake . Le convertisseur d'encodage traduit le texte entre deux des plus de 35 encodages pris en charge tout en préservant les caractères d'origine.

Comment fonctionne notre convertisseur d'encodage

  1. Sélectionnez les encodages - Choisissez l'encodage source (l'encodage dans lequel se trouve actuellement votre texte) et l'encodage cible (l'encodage vers lequel vous souhaitez convertir). Parcourez par catégorie - Unicode, occidental, cyrillique, japonais, chinois, coréen, etc. - ou recherchez par nom d'encodage ou alias.
  2. Fournir une entrée - Collez le texte directement, téléchargez un fichier texte ou choisissez parmi un exemple de texte préchargé. L'outil lit votre entrée et l'interprète à l'aide de l'encodage source sélectionné, en la convertissant en représentation Unicode interne.
  3. Convertir et copier - L'outil réencode le texte Unicode dans l'encodage cible et affiche le résultat. Copiez le texte converti dans votre presse-papiers ou téléchargez-le sous forme de fichier UTF-8 pour l'utiliser dans votre application, base de données ou flux de travail.

Catégories d'encodage expliquées

  • Encodages Unicode (UTF-8, UTF-16) : la norme moderne. UTF-8 est le codage dominant sur le Web (> 98 % des pages), dans les applications modernes, ainsi qu'en JSON, XML, HTML et la plupart des API. UTF-16 est utilisé nativement par Java, JavaScript, .NET et Windows. La conversion en UTF-8 est la cible recommandée pour une compatibilité maximale.
  • Europe occidentale et centrale (ISO-8859-1, Windows-1252, MacRoman) : encodages à un octet couvrant la plupart des langues européennes. Windows-1252 est l'encodage Windows existant le plus courant et constitue un surensemble de l'ISO-8859-1 avec des caractères imprimables supplémentaires dans la plage 0x80-0x9F.
  • Encodages cyrilliques (KOI8-R, Windows-1251, IBM866) : KOI8-R est courant sous Unix/Linux pour le texte russe. Windows-1251 est le codage cyrillique Windows standard. IBM866 est utilisé dans les systèmes DOS hérités. La conversion du texte russe existant en UTF-8 garantit la compatibilité sur toutes les plates-formes.
  • Encodages asiatiques (Shift-JIS, EUC-JP, GBK, Big5, EUC-KR) : encodages multi-octets pour les scripts japonais, chinois et coréens. Shift-JIS est le standard japonais de Windows. GBK/GB2312 sont pour le chinois simplifié. Big5 est pour le chinois traditionnel. EUC-KR est pour le coréen. La conversion en UTF-8 est essentielle pour mélanger du texte asiatique et latin.

Garantie de confidentialité et de traitement local

Le convertisseur d'encodage traite toutes les données entièrement dans votre navigateur à l'aide des API Web natives TextEncoder et TextDecoder. Votre texte et vos fichiers ne sont jamais téléchargés sur un serveur : ils sont lus à l'aide de l'API FileReader et traités localement sur votre appareil. Il n'y a aucune condition d'inscription, aucune limite d'utilisation, aucune fonctionnalité premium et aucune enregistrement de données. L'outil est entièrement gratuit pour n'importe quel objectif : conversion de texte existant, correction de Mojibake ou normalisation des encodages pour le traitement des données.

Foire aux questions

Un convertisseur d'encodage transforme le texte d'un encodage de caractères à un autre. Les codages de caractères définissent la manière dont les caractères sont représentés sous forme d'octets : par exemple, UTF-8, Windows-1252 et Shift-JIS représentent tous le même texte différemment au niveau des octets. La conversion entre les encodages est essentielle lorsque vous travaillez avec des données existantes, du texte international ou des systèmes qui attendent un encodage spécifique. Notre outil prend en charge plus de 35 encodages dans 14 catégories de langues.

Le convertisseur d'encodage prend en charge plus de 35 encodages de caractères : UTF-8, UTF-16LE, UTF-16BE, ISO-8859-1 à ISO-8859-11 et 15, Windows-1250 à Windows-1258, KOI8-R, KOI8-U, IBM437, IBM850, IBM866, MacRoman, Shift-JIS, EUC-JP, ISO-2022-JP, GBK, GB2312, GB18030, Big5, EUC-KR et plus encore. Chaque encodage comprend ses alias et une description de son utilisation.

Sélectionnez l'encodage source (ce dans quoi se trouve actuellement votre texte) et l'encodage cible (ce vers quoi vous souhaitez convertir). Collez votre texte ou téléchargez un fichier, cliquez sur « Convertir » et l'outil transcodera le texte. Vous pouvez également utiliser les boutons « Exemple de texte » pour tester instantanément des scénarios de conversion courants tels que l'Europe occidentale vers UTF-8 ou le KOI8-R russe vers UTF-8.

Oui. Passez à l'onglet « Télécharger un fichier », sélectionnez un fichier texte sur votre appareil (jusqu'à 1 Mo) et l'outil lit son contenu à l'aide de l'API FileReader. Tout traitement est strictement local : le fichier ne quitte jamais votre appareil. Après la conversion, vous pouvez copier le résultat ou le télécharger sous forme de fichier texte UTF-8.

Lorsqu'un caractère existe dans le texte source mais pas dans l'encodage cible (par exemple, lors de la conversion de caractères japonais en ISO-8859-1), le navigateur le remplace par un caractère de secours - généralement "?" ou le caractère de remplacement Unicode (U+FFFD). L'outil affiche un avertissement de conversion avec perte lorsque cela se produit. Pour une préservation complète des caractères, utilisez toujours UTF-8 comme codage cible.

ISO-8859-1 et Windows-1252 sont identiques pour les octets 0xA0-0xFF mais diffèrent dans la plage 0x80-0x9F. Dans ISO-8859-1, ces octets sont des caractères de contrôle C1. Dans Windows-1252, ils correspondent à des caractères imprimables tels que les guillemets intelligents (\u201c\u201d), le signe euro (\u20ac), la marque déposée (\u2122), la puce (\u2022) et les tirets en/em. Pour le contenu Web pratique, Windows-1252 est beaucoup plus courant.

Oui, 100 % gratuit, pour toujours. Pas d'inscription, pas de compte, pas de niveau premium, pas de limites d'utilisation et pas de publicité. Convertissez autant de texte que nécessaire entre l’un des plus de 35 encodages pris en charge. Tout le traitement est effectué localement dans votre navigateur sans aucun téléchargement sur le serveur, garantissant une confidentialité totale.

Oui. Cliquez sur le bouton d'échange (deux flèches verticales) entre les sélecteurs d'encodage source et cible pour inverser instantanément le sens de conversion. Ceci est utile pour les tests aller-retour : convertissez d'UTF-8 en Windows-1252, échangez et reconvertissez pour vérifier que le texte original est préservé.