Porque o teu assunto chega como =?UTF-8?B? e uma tira de letras
Publicado a 08/09/2026 · 3 min de leitura · Ferramentas de ficheiros
Daniel Okonkwo — Programador front-end e redator de Tecnologia na OneKitly
Desempenho web · Formatos de ficheiro
Verificado a partir de 3 fontes
Um cabeçalho só pode conter ASCII, o que não deixa lugar ao é, ao ü, ao ñ nem ao travessão. O contorno está definido na RFC 2047: o texto é envolvido como =?charset?codificação?dados?=, em que a codificação é B para base64 ou Q para uma variante de quoted-printable em que o espaço se torna um sublinhado. Assim, Réunion — ordre du jour viaja como =?UTF-8?B?UsOpdW5pb24g4oCUIG9yZHJlIGR1IGpvdXI=?= ou como =?UTF-8?Q?R=C3=A9union_=E2=80=94_ordre_du_jour?=, e ambos descodificam exatamente as mesmas palavras. As mensagens mais antigas usam =?ISO-8859-1?Q?R=E9union?= e descodificam com a mesma limpeza. O corpo é um problema à parte com a mesma forma: costuma ir em quoted-printable, em que =C3=A9 é é e uma linha que acaba num sinal de igual nu continua na seguinte. Converte a mensagem para texto simples e as duas camadas caem de uma vez — é o que torna uma mensagem guardada pesquisável e citável em vez de algo que se decifra a semicerrar os olhos.
Os cabeçalhos de correio só podem levar ASCII, por isso um assunto acentuado é codificado antes de viajar. Usam-se duas codificações, ambas começam por =?, e descodificá-las é toda a diferença entre uma mensagem legível e um muro de símbolos.
Porque duas codificações, e qual te calha
O Q deixa em paz as letras correntes e escapa só o indispensável: um assunto quase todo em inglês com um acento continua quase legível no ficheiro cru. O B codifica tudo, o que é mais curto quando a maioria dos caracteres não é ASCII — um assunto em grego ou japonês é bem mais compacto em base64 do que como tira de escapes. Os programas escolhem cabeçalho a cabeçalho, daí uma mesma mensagem levar um assunto em Q e um nome de remetente em B, e daí a necessidade de tratar ambos.
Para que serve o texto simples
Uma mensagem reduzida a texto é pesquisável por qualquer ferramenta da tua máquina, citável sem arrastar uma paginação e suficientemente pequena para guardar aos milhares. É ainda a forma que sobrevive: uma mensagem HTML de 2011 aparece diferente em cada leitor surgido desde então, ao passo que a sua alternativa de texto se lê hoje exatamente como então. Quase todas as mensagens levam ambas, e a de texto é a que ninguém olha até fazer falta.
| No ficheiro cru | Descodificado |
|---|---|
| =?UTF-8?B?UsOpdW5pb24g4oCUIG9yZHJl…?= | Réunion — ordre du jour |
| =?UTF-8?Q?R=C3=A9union_=E2=80=94_ordre…?= | Réunion — ordre du jour |
| =?ISO-8859-1?Q?R=E9union?= | Réunion |
| Réunion (não codificado) | Réunion — passa tal e qual |
Perguntas frequentes
- O meu assunto aparece «Réunion» em vez de «Réunion». O que é isso?
- O problema inverso: os bytes foram descodificados, mas com o conjunto de caracteres errado. é é o aspeto dos dois bytes de um é UTF-8 lidos como Latin-1. Vem em geral de um programa que ignorou o conjunto declarado no cabeçalho. Abrir o .eml original e deixar a ferramenta ler a declaração devolve os caracteres certos — o ficheiro nunca foi danificado, apenas mal lido.
- A versão de texto perde alguma coisa?
- A paginação, as imagens e o destino das ligações — uma ligação fica nas suas palavras, não no seu endereço, salvo se o remetente tiver escrito o endereço por extenso. O que guarda é tudo o que foi dito. Se precisares também dos endereços, escolhe a conversão para HTML ou lê a mensagem no visualizador, onde as ligações continuam ligações.
- Posso converter uma caixa inteira de uma vez?
- Divide primeiro o .mbox em ficheiros .eml individuais e converte depois os que quiseres. Esse caminho em dois tempos é deliberado: uma caixa é em geral muito maior do que o punhado de mensagens de que precisas mesmo em texto, e dividir primeiro deixa-te escolher.
Artigos que podem interessar-lhe
Todos os guias →Ferramentas relacionadas
Fontes
Detetaste um erro neste artigo?