Aller au contenu
OneKitly

Pourquoi ton objet arrive en =?UTF-8?B? suivi d'une bouillie de lettres

Publié le 08/09/2026 · 3 min de lecture · Outils fichiers

Daniel Okonkwo

Daniel Okonkwo — Développeur front-end et rédacteur Tech chez OneKitly

Performance web · Formats de fichiers

Vérifié à partir de 3 sources

Voir le profil →
En bref

Un en-tête ne peut contenir que de l'ASCII, ce qui ne laisse de place ni au é, ni au ü, ni au ñ, ni au tiret cadratin. Le contournement est défini par la RFC 2047 : le texte est enveloppé en =?charset?encodage?données?=, où l'encodage vaut B pour du base64 ou Q pour une variante du quoted-printable dans laquelle l'espace devient un tiret bas. Réunion — ordre du jour voyage donc soit en =?UTF-8?B?UsOpdW5pb24g4oCUIG9yZHJlIGR1IGpvdXI=?=, soit en =?UTF-8?Q?R=C3=A9union_=E2=80=94_ordre_du_jour?=, et les deux se décodent en exactement les mêmes mots. Les messages plus anciens emploient =?ISO-8859-1?Q?R=E9union?= et se décodent tout aussi proprement. Le corps est un problème distinct de même forme : il est d'ordinaire en quoted-printable, où =C3=A9 vaut é et où une ligne finissant par un signe égal nu continue à la suivante. Convertis le message en texte brut et les deux couches tombent d'un coup — c'est ce qui rend un message enregistré cherchable et citable plutôt que quelque chose qu'on déchiffre en plissant les yeux.

Les en-têtes de courrier n'ont droit qu'à l'ASCII : un objet accentué est donc encodé avant de voyager. Deux encodages sont en usage, tous deux commencent par =?, et les décoder fait toute la différence entre un message lisible et un mur de symboles.

Pourquoi deux encodages, et lequel tu obtiens

Le Q laisse les lettres ordinaires tranquilles et n'échappe que le nécessaire : un objet surtout anglais avec un seul accent reste presque lisible dans le fichier brut. Le B encode tout, ce qui est plus court quand la plupart des caractères ne sont pas de l'ASCII — un objet en grec ou en japonais est bien plus compact en base64 qu'en chaîne d'échappements. Les logiciels choisissent en-tête par en-tête, d'où un même message portant un objet en Q et un nom d'expéditeur en B, et d'où la nécessité de traiter les deux.

À quoi sert le texte brut

Un message réduit au texte est cherchable par tous les outils de ta machine, citable sans traîner une mise en page, et assez petit pour en garder par milliers. C'est aussi la forme qui survit : un message HTML de 2011 s'affiche différemment dans chaque lecteur apparu depuis, tandis que son alternative texte se lit aujourd'hui exactement comme alors. La plupart des messages portent les deux, et la version texte est celle que personne ne regarde jusqu'au jour où elle sert.

Le même objet, quatre façons de l'écrire
Dans le fichier brutDécodé
=?UTF-8?B?UsOpdW5pb24g4oCUIG9yZHJl…?=Réunion — ordre du jour
=?UTF-8?Q?R=C3=A9union_=E2=80=94_ordre…?=Réunion — ordre du jour
=?ISO-8859-1?Q?R=E9union?=Réunion
Réunion (pas encodé du tout)Réunion — transmis tel quel
EML en texteExtrais le texte lisible d'un e-mail enregistré, en décodant les corps quoted-printable et base64.Essayer l'outil →

Questions fréquentes

Mon objet s'affiche « Réunion » au lieu de « Réunion ». Qu'est-ce que c'est ?
Le problème inverse : les octets ont été décodés, mais avec le mauvais jeu de caractères. é est l'allure des deux octets d'un é UTF-8 lus comme du Latin-1. Cela vient en général d'un programme qui a ignoré le jeu déclaré dans l'en-tête. Ouvrir le .eml d'origine et laisser l'outil lire la déclaration rend les bons caractères — le fichier n'a jamais été abîmé, seulement mal lu.
La version texte perd-elle quelque chose ?
La mise en page, les images et la destination des liens — un lien devient ses mots, pas son adresse, sauf si l'expéditeur a écrit l'adresse en toutes lettres. Ce qu'elle garde, c'est tout ce qui a été dit. S'il te faut aussi les adresses, prends la conversion HTML ou lis le message dans le visualiseur, où les liens restent des liens.
Puis-je convertir toute une boîte d'un coup ?
Découpe d'abord le .mbox en fichiers .eml individuels, puis convertis ceux que tu veux. Ce chemin en deux temps est délibéré : une boîte est en général bien plus grosse que la poignée de messages dont tu as réellement besoin en texte, et découper d'abord te laisse choisir.

Articles qui pourraient t'intéresser

Tous les guides →
ExplicationLe HTML d'un e-mail a vingt ans de retard sur le web, volontairementPas de feuille de style, pas de script, une mise en page faite de tableaux imbriqués et des styles écrits sur chaque balise. Savoir pourquoi explique ce à quoi un fichier HTML exporté ressemblera — et ce à quoi il ne ressemblera pas.ExplicationUne pièce jointe grossit d'un tiers dans l'e-mailLe courrier transporte les fichiers en texte, trois octets écrits en quatre caractères. Une pièce jointe de 10 Mio occupe 13,68 Mio du message — d'où le fait qu'une limite de 25 Mo signifie en réalité environ 18 Mio de fichiers.TutorielOuvrir un fichier .eml sans prévenir l'expéditeurUn message enregistré est un fichier texte lisible partout. Le hic, c'est qu'ouvrir ce fichier dans un logiciel qui charge les images distantes annonce l'instant où tu l'as fait — c'est précisément à quoi sert un pixel espion.ExplicationUn .mbox, ce sont des messages collés bout à bout, et la colle est une ligneUn fichier, des milliers de messages, séparés par une ligne commençant par From. Le format a une faiblesse célèbre, et c'est la raison pour laquelle un message peut perdre sa fin sans que rien ne signale d'erreur.TutorielDécouper une archive de courrier en un fichier par messageUn .mbox est un seul fichier énorme que ton système ne sait pas fouiller. Transforme-le en fichiers .eml et chaque message devient quelque chose que ta machine indexe, que ton logiciel de messagerie ouvre, et que tu peux supprimer un par un.ExplicationUn événement récurrent fait une ligne dans le CSV, pas douzeUn fichier .ics range une réunion hebdomadaire une seule fois, avec une règle attachée. À l'export CSV tu obtiens une ligne pour toute la série — c'est le fichier qui est honnête, pas le convertisseur qui perd des lignes.

Outils similaires

Sources

Tu as repéré une erreur dans cet article ?