Ir para o conteúdo
OneKitly

Porque o teu assunto chega como =?UTF-8?B? e uma tira de letras

Publicado a 08/09/2026 · 3 min de leitura · Ferramentas de ficheiros

Daniel Okonkwo

Daniel Okonkwo — Programador front-end e redator de Tecnologia na OneKitly

Desempenho web · Formatos de ficheiro

Verificado a partir de 3 fontes

Ver perfil →
Em resumo

Um cabeçalho só pode conter ASCII, o que não deixa lugar ao é, ao ü, ao ñ nem ao travessão. O contorno está definido na RFC 2047: o texto é envolvido como =?charset?codificação?dados?=, em que a codificação é B para base64 ou Q para uma variante de quoted-printable em que o espaço se torna um sublinhado. Assim, Réunion — ordre du jour viaja como =?UTF-8?B?UsOpdW5pb24g4oCUIG9yZHJlIGR1IGpvdXI=?= ou como =?UTF-8?Q?R=C3=A9union_=E2=80=94_ordre_du_jour?=, e ambos descodificam exatamente as mesmas palavras. As mensagens mais antigas usam =?ISO-8859-1?Q?R=E9union?= e descodificam com a mesma limpeza. O corpo é um problema à parte com a mesma forma: costuma ir em quoted-printable, em que =C3=A9 é é e uma linha que acaba num sinal de igual nu continua na seguinte. Converte a mensagem para texto simples e as duas camadas caem de uma vez — é o que torna uma mensagem guardada pesquisável e citável em vez de algo que se decifra a semicerrar os olhos.

Os cabeçalhos de correio só podem levar ASCII, por isso um assunto acentuado é codificado antes de viajar. Usam-se duas codificações, ambas começam por =?, e descodificá-las é toda a diferença entre uma mensagem legível e um muro de símbolos.

Porque duas codificações, e qual te calha

O Q deixa em paz as letras correntes e escapa só o indispensável: um assunto quase todo em inglês com um acento continua quase legível no ficheiro cru. O B codifica tudo, o que é mais curto quando a maioria dos caracteres não é ASCII — um assunto em grego ou japonês é bem mais compacto em base64 do que como tira de escapes. Os programas escolhem cabeçalho a cabeçalho, daí uma mesma mensagem levar um assunto em Q e um nome de remetente em B, e daí a necessidade de tratar ambos.

Para que serve o texto simples

Uma mensagem reduzida a texto é pesquisável por qualquer ferramenta da tua máquina, citável sem arrastar uma paginação e suficientemente pequena para guardar aos milhares. É ainda a forma que sobrevive: uma mensagem HTML de 2011 aparece diferente em cada leitor surgido desde então, ao passo que a sua alternativa de texto se lê hoje exatamente como então. Quase todas as mensagens levam ambas, e a de texto é a que ninguém olha até fazer falta.

O mesmo assunto, quatro maneiras de o escrever
No ficheiro cruDescodificado
=?UTF-8?B?UsOpdW5pb24g4oCUIG9yZHJl…?=Réunion — ordre du jour
=?UTF-8?Q?R=C3=A9union_=E2=80=94_ordre…?=Réunion — ordre du jour
=?ISO-8859-1?Q?R=E9union?=Réunion
Réunion (não codificado)Réunion — passa tal e qual
EML para textoExtrai o texto legível de um e-mail guardado, descodificando corpos quoted-printable e base64.Experimentar a ferramenta →

Perguntas frequentes

O meu assunto aparece «Réunion» em vez de «Réunion». O que é isso?
O problema inverso: os bytes foram descodificados, mas com o conjunto de caracteres errado. é é o aspeto dos dois bytes de um é UTF-8 lidos como Latin-1. Vem em geral de um programa que ignorou o conjunto declarado no cabeçalho. Abrir o .eml original e deixar a ferramenta ler a declaração devolve os caracteres certos — o ficheiro nunca foi danificado, apenas mal lido.
A versão de texto perde alguma coisa?
A paginação, as imagens e o destino das ligações — uma ligação fica nas suas palavras, não no seu endereço, salvo se o remetente tiver escrito o endereço por extenso. O que guarda é tudo o que foi dito. Se precisares também dos endereços, escolhe a conversão para HTML ou lê a mensagem no visualizador, onde as ligações continuam ligações.
Posso converter uma caixa inteira de uma vez?
Divide primeiro o .mbox em ficheiros .eml individuais e converte depois os que quiseres. Esse caminho em dois tempos é deliberado: uma caixa é em geral muito maior do que o punhado de mensagens de que precisas mesmo em texto, e dividir primeiro deixa-te escolher.

Artigos que podem interessar-lhe

Todos os guias →
ExplicaçãoO HTML de um e-mail tem vinte anos de atraso sobre a web, de propósitoSem folha de estilo, sem script, paginação feita de tabelas encaixadas e estilos escritos em cada etiqueta. Saber porquê explica com o que um ficheiro HTML exportado se vai parecer — e com o que não.ExplicaçãoUm anexo cresce um terço dentro do e-mailO correio transporta os ficheiros em texto, três bytes escritos em quatro caracteres. Um anexo de 10 MiB ocupa 13,68 MiB da mensagem, pelo que um limite de 25 MB significa na realidade cerca de 18 MiB de ficheiros.TutorialAbrir um ficheiro .eml sem avisar o remetenteUma mensagem guardada é um ficheiro de texto legível em qualquer lado. O senão é que abri-la em algo que carrega imagens remotas anuncia o momento em que o fizeste — é precisamente para isso que serve um píxel de rastreio.ExplicaçãoUm .mbox são mensagens coladas umas a seguir às outras, e a cola é uma linhaUm ficheiro, milhares de mensagens, separadas por uma linha que começa por From. O formato tem uma fraqueza famosa, e é a razão pela qual uma mensagem pode perder o seu fim sem que nada assinale um erro.TutorialDividir um arquivo de correio num ficheiro por mensagemUm .mbox é um único ficheiro enorme que o teu sistema não sabe pesquisar. Transforma-o em ficheiros .eml e cada mensagem passa a ser algo que a tua máquina indexa, o teu cliente de correio abre e podes apagar um a um.ExplicaçãoUm evento recorrente é uma linha do CSV, não dozeUm ficheiro .ics guarda uma reunião semanal uma só vez, com uma regra anexa. Ao exportar para CSV obténs uma linha para toda a série — é o ficheiro a ser honesto, não o conversor a perder linhas.

Ferramentas relacionadas

Fontes

Detetaste um erro neste artigo?