Convertisseur d'encodage de fichiers (UTF-8 avec BOM, Shift_JIS)

Convertissez l'encodage d'un fichier CSV ou texte. Ajoutez un BOM pour qu'Excel ouvre l'UTF-8 correctement, ou convertissez en Shift_JIS. Tout se passe dans votre navigateur.

Réglages recommandés selon l'usage

L'encodage approprié dépend du destinataire. À utiliser comme repère.

Ce que vous voulez faire Réglage recommandé
Ouvrir un CSV UTF-8 directement dans Excel UTF-8 avec BOM
Importer dans un logiciel de gestion ancien Shift_JIS avec CRLF
Lire le fichier depuis un programme UTF-8 sans BOM et LF
Ouvrir dans Excel pour Mac UTF-8 avec BOM
Importer dans Google Sheets UTF-8, BOM facultatif
Préparer un texte pour un client de messagerie ancien ISO-2022-JP (JIS)

Les encodages en bref

Ce que cet outil prend en charge et les points de vigilance.

Encodage Remarques
UTF-8 La norme actuelle ; couvre toutes les écritures et les émojis.
UTF-8 avec BOM Trois octets de marquage au début pour qu'Excel ne se trompe pas d'encodage.
Shift_JIS Longtemps utilisé sur Windows japonais. Ne gère ni les émojis ni certains kanji variants.
EUC-JP Encodage japonais surtout utilisé sur les systèmes UNIX.
ISO-2022-JP (JIS) L'encodage du courrier japonais. Ne gère pas les katakana demi-largeur.

Pourquoi les fichiers CSV s'affichent en caractères illisibles

Lorsque les caractères se désagrègent à l'ouverture d'un CSV dans Excel, la cause est presque toujours un décalage entre l'encodage du fichier et celui qu'Excel présume. En l'absence de tout repère dans le CSV, Excel sous Windows suppose que le contenu est dans l'encodage historique local — en environnement japonais, le Shift_JIS. Or les services web et les programmes écrivent aujourd'hui le plus souvent en UTF-8, et lire une suite d'octets UTF-8 comme du Shift_JIS produit des chaînes disloquées telles que « 譁�蟄怜喧縺� ».

Deux solutions existent. La première consiste à convertir le fichier en Shift_JIS ; la seconde à le laisser en UTF-8 et à ajouter en tête un BOM (Byte Order Mark, un repère de 3 octets). Avec un BOM, Excel reconnaît « ceci est de l'UTF-8 » et les caractères illisibles disparaissent sans toucher au contenu. Cet outil gère les deux conversions et détermine automatiquement l'encodage du fichier d'origine. Le traitement se déroule entièrement dans le navigateur : le fichier n'est jamais envoyé à un serveur.

Comment utiliser la conversion d'encodage

  1. Choisir le fichier Glissez-déposez un fichier CSV ou texte, ou cliquez pour le sélectionner. À la lecture, l'encodage et la fin de ligne sont déterminés automatiquement.
  2. Vérifier la détection dans l'aperçu Si les caractères se lisent correctement dans l'aperçu, la détection a réussi. S'ils paraissent disloqués, vous avez peut-être choisi autre chose qu'un fichier texte.
  3. Choisir l'encodage de destination Pour une ouverture dans Excel, « UTF-8 » avec « ajouter un BOM » ; pour un import dans un système métier ancien, « Shift_JIS ».
  4. Télécharger Appuyez sur « Convertir et télécharger » : le fichier est enregistré avec un suffixe d'encodage ajouté au nom d'origine (_utf8bom, _sjis, etc.).

Astuces pour en tirer le meilleur parti

  • Si le fichier doit seulement s'ouvrir dans Excel, UTF-8 avec BOM est le choix le plus sûr : aucun caractère n'est perdu.
  • La conversion en Shift_JIS remplace par « ? » les caractères non représentables. L'outil les énumère au préalable.
  • N'ajoutez pas de BOM aux fichiers lus par un programme : il finit généralement dans le nom de la première colonne.

Quand cela vous sert

Un CSV exporté d'un service web est illisible dans Excel

Beaucoup de services exportent données de ventes ou listes d'adhérents en UTF-8 ; ouverts directement dans Excel, les caractères se brouillent. Ajouter un BOM suffit.

Impossible d'importer dans un logiciel comptable ou de paie

Les systèmes métier anciens n'acceptent parfois que des CSV en Shift_JIS. Convertissez le fichier UTF-8 en Shift_JIS pour que l'import passe.

Lire un CSV avec BOM par programme fausse la première colonne

Le BOM est constitué de trois octets invisibles et se glisse dans le premier nom de champ si on lit tel quel. Convertir en UTF-8 sans BOM règle le problème.

Des fins de ligne différentes (CRLF/LF) font passer tout le fichier pour une seule ligne

Un fichier créé sur Mac en LF peut apparaître comme une seule ligne dans une vieille application Windows, les retours étant ignorés. Convertir en CRLF avant de le transmettre règle cela. À l'inverse, un fichier CRLF créé sous Windows laisse un ^M en fin de ligne dans les commandes Unix : convertissez alors en LF.

Consulter le contenu d'un fichier illisible

Comme l'encodage est détecté automatiquement et le fichier relu correctement, vous pouvez voir dans l'aperçu le contenu d'un fichier qui refusait de s'ouvrir lisiblement.

Les termes de l'encodage de caractères

Encodage de caractères
La règle qui fait correspondre les caractères aux suites d'octets dans l'ordinateur. Si la règle diffère entre l'écriture et la lecture, les caractères deviennent illisibles.
BOM
Abréviation de Byte Order Mark, un repère de 3 octets (EF BB BF) placé en tête de fichier. Il indique aux applications qu'il s'agit d'UTF-8, mais peut être traité comme un caractère parasite lors d'une lecture par programme.
Fin de ligne
Les octets qui marquent la fin d'une ligne. Windows utilise CRLF (2 octets), Mac et Linux LF (1 octet) : d'un système à l'autre, tout peut sembler tenir sur une ligne ou des lignes surnuméraires apparaissent.
Shift_JIS
Un encodage longtemps très répandu dans l'environnement Windows japonais. Il couvre moins de caractères qu'UTF-8 et ne peut représenter ni les emojis ni certaines variantes de caractères.
Caractères illisibles (mojibake)
L'état où, après une lecture dans le mauvais encodage, s'alignent des caractères dépourvus de sens. Une suite comme « 譁�蟄怜喧 » est le cas typique d'un UTF-8 lu comme du Shift_JIS.

Questions fréquentes

Si seul Excel ouvre le fichier, choisissez UTF-8 avec BOM : le problème disparaît sans perdre de caractère. Shift_JIS n'est nécessaire que si le système destinataire l'exige.

Trois octets (EF BB BF) au début du fichier. Ils ne s'affichent pas comme du texte, mais des applications comme Excel s'en servent pour identifier l'UTF-8.

Non. Détection, conversion et téléchargement ont lieu dans votre navigateur ; le contenu ne quitte pas votre appareil.
Tool-kun

Anecdote — Ce que révèle un texte illisible

Un texte illisible suit des motifs reconnaissables. Les suites de kanji sans rapport apparaissent quand des octets UTF-8 sont lus comme du Shift_JIS : un caractère japonais occupe trois octets en UTF-8, les relire deux par deux produit donc des caractères entièrement différents. L'erreur inverse donne des rangées de caractères de remplacement, les séquences d'octets étant invalides.

Le BOM a été inventé pour UTF-16, où il indique l'ordre des octets. UTF-8 n'a pas cette ambiguïté et la norme Unicode déconseille d'en mettre ; il a néanmoins survécu dans le monde Windows, car les applications qui ne peuvent que deviner l'encodage avaient besoin d'un marqueur explicite.