Aller au contenu
OneKitly

Transformer des notes en un PDF qui mérite d'être archivé

Publié le 13/07/2026 · 20 min de lecture · Outils fichiers

Daniel Okonkwo

Daniel OkonkwoDéveloppeur front-end et rédacteur Tech chez OneKitly

Performance web · Formats de fichiers

Vérifié à partir de 5 sources

Voir le profil
En bref

Un fichier .txt contient des caractères et des retours à la ligne, rien de plus — pas de page, pas de marge, pas de police, aucune idée de l'endroit où une page devrait finir et la suivante commencer. Le transformer en PDF revient donc à inventer une mise en page, et la seule chose honnête qu'un convertisseur puisse faire est de te dire laquelle il a inventée. Celui-ci pose ton texte sur du A4 à 595,28 sur 841,89 points, soit exactement 210 sur 297 millimètres, avec une marge de 56 points tout autour laissant une colonne de texte de 483,28 points de large, environ 170 millimètres. Il utilise Helvetica à la taille que tu choisis entre 8 et 28 points, 12 par défaut, avec un interligne de 1,42 fois la taille. À 12 points cela donne 17,04 points par ligne et 43 lignes sur une page ; à 8 points, 65 lignes ; à 28 points, 19. Il replie chacune de tes lignes sur les espaces pour ne rien couper au milieu d'un mot. Trois limites méritent d'être connues avant de coller quoi que ce soit. Helvetica est une police proportionnelle et non à chasse fixe : 181 lettres étroites ou seulement 48 lettres larges tiennent sur la même ligne, et tout ce que tu avais disposé en colonnes ne s'alignera pas. Un mot unique plus long que la colonne — une longue adresse web, une empreinte, un bloc encodé — n'est jamais coupé : il déborde par la droite de la page et se perd purement et simplement. Et le texte est écrit dans un encodage à un octet : tout caractère au-delà de U+00FF devient un point d'interrogation. Les lettres accentuées des six langues de ce site survivent, mais le symbole €, les guillemets courbes, les tirets cadratins, les points de suspension et toutes les écritures non latines, non. Une tabulation est pire que perdue : elle ne peut pas être encodée du tout et fait échouer la conversion avec un message d'erreur générique. Remplace les tabulations par des espaces avant de coller, et l'outil fait le reste.

Le texte brut n'a pas de mise en page : tout convertisseur doit donc en inventer une pour toi. Voici exactement les décisions que prend celui-ci — page, marges, police, retours à la ligne — ce qu'il fait d'une tabulation et d'une longue ligne, et ce qu'il te reste à ajouter pour qu'une note mérite d'être conservée.

Le texte brut n'a pas de mise en page, le convertisseur doit donc en inventer une

On oublie facilement le peu que contient réellement un fichier .txt. C'est une suite de caractères, dont certains marquent la fin d'une ligne, et c'est tout le contenu. Il n'y a pas de page dedans, parce que la notion de page n'existe pas. Pas de police, pas de taille, pas de marge, pas de retrait, pas de gras, pas de titre. Quand tu regardes un fichier texte, il semble avoir une forme, mais cette forme appartient à la fenêtre dans laquelle tu le regardes — rétrécis la fenêtre et la forme change, parce que c'est ton éditeur qui replie les lignes, en direct, sans rien en garder.

Un PDF est un objet de nature inverse. Il décrit exactement où chaque morceau de texte se place sur une page de dimensions fixes, ce qui explique qu'il ait la même apparence partout et qu'il s'imprime sans surprise. Passer de l'un à l'autre exige donc de fournir toutes les informations que le fichier texte n'a pas. Il n'existe pas de bonne réponse sur ce qu'elles doivent être, seulement un ensemble de choix défendables, et un convertisseur qui cache ses choix ne fait pas preuve de modestie : il t'empêche de prévoir ce que tu obtiendras.

Les voici donc, lus dans le code source plutôt que devinés. La page est un A4 de 595,28 sur 841,89 points ; un point valant un soixante-douzième de pouce, cela fait 210 sur 297 millimètres à la deuxième décimale, soit exactement la définition de l'ISO 216. La marge est de 56 points de chaque côté, environ 19,8 millimètres, laissant une colonne de texte de 483,28 points, soit 170,5 millimètres de large. L'interligne vaut 1,42 fois le corps, donc 17,04 points au corps 12 par défaut. La première ligne de base se situe 68 points sous le haut de la page et la dernière environ 58 points au-dessus du bas, assez proche de la symétrie pour que personne ne le remarque. Quarante-trois lignes tiennent au corps 12, 65 au corps 8, 47 au corps 11, 37 au corps 14 et 19 au maximum de 28.

Helvetica est une police proportionnelle, et cela décide de ce à quoi cet outil est bon

Dans une police à chasse fixe, chaque caractère occupe la même largeur, propriété qui fait s'aligner les colonnes sans effort : place une valeur en vingtième position sur chaque ligne et elle apparaît au même endroit partout. Helvetica n'est pas de cette famille. Mesuré dans la colonne de texte de l'outil au corps 12, un i minuscule fait 2,66 points de large et il en tient 181 sur une ligne ; un M majuscule fait 10 points et il n'en tient que 48. Soit un rapport de près de quatre à un entre le caractère le plus étroit et le plus large sur une même ligne.

La conséquence pratique est sans ambiguïté. Tout ce dont le sens dépend de la position horizontale — un tableau aligné avec des espaces, un journal avec des horodatages alignés, un listing de code avec des blocs indentés, une facture avec une colonne de montants à droite — ressort en dents de scie. Ni corrompu, ni illisible, simplement plus aligné, et après en avoir vu une page tu n'auras pas envie de l'archiver. La prose, en revanche, est exactement ce pour quoi une police proportionnelle existe : au corps 12, une phrase mêlée fait en moyenne 5,58 points par caractère, donc environ 86 caractères par ligne et près de 3 700 par page, ce qui se lit aussi confortablement que ce que composerait n'importe quel traitement de texte.

La police compte pour une seconde raison, qui ne se révèle que le jour où quelqu'un ouvrira le fichier dans vingt ans. Helvetica fait partie des quatorze polices de base que tout lecteur PDF est tenu de fournir depuis la publication du format : elle est donc référencée par son nom et ses contours ne sont pas stockés dans le fichier. C'est pourquoi un PDF d'une page produit par cet outil pèse moins d'un kilooctet : il contient ton texte, une description de page et un renvoi vers une police que le lecteur est censé déjà posséder. Il s'affiche partout aujourd'hui et s'affichera presque certainement partout demain — mais c'est une dépendance à quelque chose d'extérieur au fichier, et les normes d'archivage y sont sensibles. Nous y venons.

Trois choses qui cassent, et que faire pour chacune

La tabulation est le cas tranchant, elle passe donc en premier. Le texte est écrit dans le PDF avec un encodage à un octet qui n'a aucune case pour un caractère de tabulation, et la conversion ne l'ignore pas ni ne le convertit en espaces : elle s'arrête. Tu vois le message générique de l'outil disant qu'il n'a pas pu créer le PDF, sans la moindre indication de cause, et il en va de même pour un saut de page et pour toute la plage de caractères de contrôle qu'un fichier journal ou une capture de terminal peut contenir sans qu'on le sache. C'est un défaut et il est signalé comme tel. En attendant qu'il soit corrigé, le contournement coûte cinq secondes : remplace chaque tabulation par deux, quatre ou huit espaces dans un éditeur de texte avant de coller. La police étant proportionnelle, les colonnes n'allaient de toute façon pas s'aligner : la substitution ne fait rien perdre.

La deuxième est la ligne trop longue pour être coupée. Le mécanisme de repli cherche des espaces ; quand il n'en trouve pas, il abandonne et écrit le mot entier sur une seule ligne, quelle que soit sa largeur. Une adresse web de 180 caractères au corps 12 mesure 1 177,7 points et se termine à la position horizontale 1 233,7 sur une page qui n'en fait que 595,28, si bien que plus d'un demi-mètre se retrouve hors du papier. Ce n'est ni tronqué avec des points de suspension, ni reporté à la ligne suivante, ni signalé : c'est simplement dessiné là où personne ne peut le voir. Les longues URL, les empreintes cryptographiques, les blocs encodés et le code minifié en sont les victimes habituelles. Coupe-les à la main sur une barre oblique ou un tiret avant la conversion, et vérifie la marge droite du PDF terminé avant de l'archiver.

La troisième est le caractère que l'encodage ne peut pas contenir. Tout ce qui va jusqu'à U+00FF passe, ce qui couvre les lettres accentuées des six langues de ce site — café, naïve, Peña, informação, Straße, città arrivent intacts. Tout ce qui se trouve au-delà de ce point de code est remplacé par un point d'interrogation. En pratique, les victimes sont celles qu'on récupère en collant depuis un traitement de texte ou une messagerie : guillemets courbes, apostrophes typographiques, tirets cadratins et demi-cadratins, caractère de points de suspension, et — détail notable sur un site européen — le symbole €, qui se situe en U+20AC et ne survit pas, alors que le symbole dollar et le symbole livre, situés plus bas, survivent. Les écritures non latines sont entièrement perdues. Tape tes guillemets et tes tirets en ASCII simple, écris en toutes lettres toute devise que tu ne peux pas risquer de perdre, et vérifie la première page.

Ce que contient réellement le PDF

Ouvre le résultat dans un lecteur et essaie de sélectionner une phrase. Elle se sélectionne, parce que le texte de ce PDF est du texte — une suite de caractères positionnés sur la page, et non une image de caractères. Cette seule propriété fait la différence entre un fichier que l'on peut chercher, copier, donner à un lecteur d'écran et indexer, et un scan, qui est une image de document et exige une reconnaissance optique de caractères avant qu'une machine puisse en faire quoi que ce soit. Si tu convertis parce qu'une note doit survivre et rester retrouvable, c'est la propriété qui compte le plus, et c'est celle que cet outil réussit.

Ce que le fichier ne contient pas mérite tout autant d'être connu. Son dictionnaire de métadonnées porte le nom de la bibliothèque qui l'a produit et deux horodatages — l'instant où tu as cliqué, en temps universel. Il n'y a ni titre, ni auteur, ni sujet, ni mots-clés, ni balise de langue. Il n'y a pas non plus d'arbre de structure, cette couche qui indique à un lecteur d'écran quel texte est un titre et dans quel ordre lire la page : le document n'est donc pas balisé. Et il n'y a aucun paquet de métadonnées XMP. Chacune de ces absences est normale et sans importance pour un petit utilitaire, et chacune compte si le mot archive est employé au sens strict.

Ce sens strict a un nom et un corps de règles. Le PDF/A, normalisé sous l'ISO 19005, est le format que les archives et les bibliothèques nationales acceptent réellement, et la Bibliothèque du Congrès en résume deux exigences en une ligne chacune : toutes les polices doivent être incorporées et légalement incorporables pour un rendu universel et illimité, et l'usage de XMP est obligatoire pour les métadonnées descriptives et identifiantes de base. Tout l'objet, comme le formule la Bibliothèque, est que le PDF/A soit contraint d'éviter les dépendances externes. La sortie de cet outil échoue sur les deux points : elle pointe vers Helvetica au lieu de l'emporter, et elle ne transporte aucun XMP. C'est un parfaitement bon PDF. Ce n'est pas un PDF/A, et si un tribunal, un service d'archives ou un régime de conformité t'en réclame un, ce n'est pas la voie à suivre.

Ce qu'il te reste à ajouter

Pour tout ce qui n'est pas de l'archivage formel — une note de réunion, une trace de décision, une sortie de terminal conservée comme preuve, un texte que tu veux figer — le fichier fait l'affaire, à condition de mettre ce qu'il ne peut pas stocker au seul endroit dont il dispose : le texte. Commence le document par quatre lignes. De quoi il s'agit. Quand cela s'est passé, en date complète avec une année à quatre chiffres pour qu'elle ne puisse être mal lue nulle part. Qui l'a écrit. D'où cela vient, que ce soit un nom de système, une adresse ou une personne. Ces quatre lignes ne coûtent rien et font la différence entre un document et un orphelin.

Renomme ensuite le téléchargement. Il arrive sous le nom document.pdf, sans condition, à chaque fois, et il n'y a pas pire habitude pour un dossier que tu comptes consulter dans cinq ans. Un nom qui se trie et se lit seul — la date d'abord en année, mois, jour, puis un sujet court, puis la source — rend l'archive navigable sans aucune métadonnée, ce qui tombe bien puisque le fichier n'en porte pas. Si tu produises plusieurs notes, fusionne-les en un seul PDF daté plutôt que d'accumuler des fragments ; et si le résultat part dans une boîte mail ou un ticket, fais-le passer par la compression, même s'il n'y a en général rien à compresser à moins d'un kilooctet la page.

Enfin, sache où t'arrêter. C'est le bon outil pour une note, un journal, une transcription, une licence, un lot de sorties de terminal, une correspondance que tu veux figer sous une forme que personne ne modifiera au passage. C'est le mauvais outil pour tout ce qui exige des titres, des tableaux, une pagination, un logo, du gras ou une seconde colonne — non parce qu'il les fait mal, mais parce qu'il ne les fait pas du tout, et forcer du texte brut dans une forme qu'il n'a pas produit quelque chose de pire que l'un ou l'autre. Pour cela, rédige dans un traitement de texte et exporte depuis là. La vertu de ce convertisseur est de ne faire qu'une promesse et de la tenir : tes caractères, sur une page, dans l'ordre où tu les as écrits, dans un fichier qui s'ouvrira encore dans vingt ans.

Chaque décision de mise en page que le convertisseur prend à ta place, lue dans son code source et mesurée sur la bibliothèque qu'il emploie
DécisionCe qu'il utiliseCe que cela implique pour toi
Format de pageA4 : 595,28 × 841,89 pt, soit exactement 210 × 297 mmAucune option Letter ; une imprimante américaine le mettra à l'échelle ou le rognera
Marges56 pt (19,8 mm) partout ; colonne de texte de 483,28 pt (170,5 mm)De la place pour une perforation, pas pour une reliure
PoliceHelvetica, l'une des 14 polices de base, référencée par son nom et non incorporéeMoins de 1 Ko par page, s'ouvre partout — mais ne peut pas être un PDF/A
Corps et interligne8 à 28 pt, 12 par défaut ; interligne à 1,42 × le corps (17,04 pt au corps 12)43 lignes par page au corps 12, 65 au corps 8, 19 au corps 28
Retour à la ligneReplie sur les espaces uniquement ; un mot plus long n'est jamais coupéUne URL de 180 caractères dépasse le bord du papier de 638 pt et se perd
Tabulations et caractères de contrôleNe peuvent pas être encodés ; la conversion s'arrête sur une erreur génériqueRemplace chaque tabulation par des espaces avant de coller
Caractères au-delà de U+00FFRemplacés par un point d'interrogationLes accents survivent ; le symbole €, les guillemets courbes, les tirets longs et les écritures non latines, non
Métadonnées et nom de fichierProducteur et deux horodatages ; ni titre, ni auteur, ni langue, ni XMP ; toujours document.pdfMets le titre et la date dans le texte lui-même, et renomme le téléchargement
TXT en PDFÉcris ou colle ton texte, mets-le en forme — gras, italique, souligné, taille, couleur, alignement — et obtiens un PDF qui le respecte.Essayer l'outil

Questions fréquentes

Il dit qu'il n'a pas pu créer le PDF sans donner de raison. Qu'est-ce qui ne va pas ?
Dans la quasi-totalité des cas, c'est une tabulation. Le texte est écrit dans le PDF avec un encodage à un octet qui n'a pas de position pour une tabulation, et plutôt que de la remplacer ou de l'ignorer, la conversion s'arrête et l'outil affiche son unique message d'échec générique. Il en va de même pour un saut de page et pour le reste des caractères de contrôle, d'où la fréquence de la panne sur les fichiers journaux, les captures de terminal et le code collé depuis un éditeur qui indente avec des tabulations. Le contournement consiste à ouvrir le texte dans n'importe quel éditeur et à remplacer chaque tabulation par des espaces avant de coller — deux, quatre ou huit, selon la façon dont tu le lisais. Cela ne fait rien perdre, puisque la police est proportionnelle et que les colonnes ne se seraient de toute façon pas alignées. Que le message soit générique au lieu d'indiquer le caractère fautif est une vraie lacune, et elle a été signalée.
Où sont passés mon symbole € et mes guillemets courbes ?
Ils ont été remplacés par des points d'interrogation à l'entrée du PDF. Avant de tracer chaque ligne, l'outil retire tout caractère au-delà de U+00FF, et le symbole € se situe en U+20AC, tout comme les guillemets courbes, les apostrophes typographiques, les tirets cadratins et demi-cadratins et le caractère de points de suspension, tous voisins. Les lettres accentuées du Latin-1 sont en deçà de cette frontière et passent intactes : voilà pourquoi café, naïve, Peña, informação, Straße et città survivent, et pourquoi le symbole dollar et le symbole livre aussi. La substitution est plus large que strictement nécessaire — l'encodage réellement employé par le PDF dispose de places pour plusieurs des caractères supprimés — c'est donc à corriger et cela a été signalé. En attendant : tape des guillemets droits et des traits d'union, écris en toutes lettres toute devise que tu ne peux pas perdre, et jette un œil à la première page avant d'archiver.
Pourquoi mes colonnes ne sont-elles plus alignées ?
Parce qu'Helvetica est une police proportionnelle et que l'alignement que tu avais était une illusion produite par la police à chasse fixe de ton éditeur. Dans une police à chasse fixe, chaque caractère occupe la même largeur : compter des caractères revient à mesurer une distance, et des colonnes fais d'espaces s'alignent gratuitement. Helvetica accorde à chaque caractère sa largeur naturelle : dans la colonne de texte de cet outil au corps 12, 181 i minuscules tiennent sur une ligne, mais seulement 48 M majuscules. Chaque ligne finit donc avec une longueur physique différente même à nombre de caractères égal, et rien de ce que tu taperas n'y changera quoi que ce soit, l'outil ne proposant aucun choix de police. Si l'alignement compte, ce n'est pas le bon outil pour ce document — reprends le texte dans un éditeur ou un traitement de texte, compose-le en chasse fixe là-bas, et exporte le PDF depuis là. S'il ne compte pas, retire les espaces de remplissage et laisse le texte être de la prose.
Combien de pages fera mon fichier ?
Compte les lignes et divise. Au corps 12 par défaut, chaque page en contient 43 : un journal de 2 000 lignes fait donc 47 pages ; au corps 8, une page en contient 65 et le même journal fait 31, soit un tiers d'économie. Le corps 11 donne 47 lignes par page, le corps 14 en donne 37, et le maximum de 28 en donne 19. N'oublie pas qu'il s'agit des lignes après repli, non des lignes de ton fichier : toute ligne source plus longue que 86 caractères environ au corps 12 en occupera deux ou plus, si bien qu'un fichier de longs paragraphes produit plus de pages que ne le suggère le décompte brut. Si tu préfères raisonner en caractères, une page pleine au corps 12 en contient environ 3 700 en prose ordinaire. L'outil affiche le nombre réel de pages à côté du bouton de téléchargement une fois le fichier construit : le moyen le plus économique de savoir est donc de convertir une fois et de regarder.
Est-ce un PDF/A ? Puis-je l'utiliser pour un archivage légal ou réglementaire ?
Non, et la raison est précise, ce n'est pas une question de degré. Le PDF/A, la famille ISO 19005, existe pour qu'un document puisse être affiché dans plusieurs décennies sans dépendre de quoi que ce soit d'extérieur au fichier. La Bibliothèque du Congrès énonce clairement deux de ses exigences : toutes les polices doivent être incorporées et légalement incorporables pour un rendu universel et illimité, et l'usage de XMP est obligatoire pour les métadonnées descriptives et identifiantes de base. La sortie de cet outil ne satisfait ni l'une ni l'autre. Elle nomme Helvetica au lieu d'en emporter les contours, et elle n'écrit aucun paquet XMP. Elle produit en outre un document non balisé, sans arbre de structure pour indiquer aux technologies d'assistance l'ordre de lecture. Pour une note interne, un dossier personnel ou une pièce jointe, rien de tout cela n'est un problème — le fichier est un PDF valide qui s'ouvrira dans n'importe quel lecteur pendant très longtemps. Pour un dépôt judiciaire, un versement aux archives, une obligation de conservation réglementée ou un dépôt en bibliothèque nationale, fais passer le résultat par un outil de conversion PDF/A dédié et valide-le ensuite, car même les logiciels qui prétendent produire du PDF/A produisent fréquemment des fichiers qui échouent à la validation.

Articles qui pourraient t'intéresser

Tous les guides
GuideCe qu'un PDF dit de toi : lire et effacer ses métadonnéesUn PDF porte ses métadonnées deux fois, dans deux magasins qui peuvent raconter des histoires différentes, et aucun des deux n'est l'histoire complète. Voici ce qui est réellement dans le fichier, ce qu'un effacement retire, et les deux choses qui survivent à tout nettoyage.TutorielPhotographier un document et obtenir un PDF acceptéPlus personne n'a de scanner, alors c'est le téléphone qui s'en charge. Deux choses décident si le résultat est accepté : la façon dont tu as pris la photo, et la taille de page qu'elle devient. La seconde surprend, car une photographie transformée en PDF n'est pas au format A4 à moins que quelque chose ne l'y contraigne.TutorielFusionner un dossier en un seul PDF, dans le bon ordreUn dossier de location, une demande de prêt, une candidature à un appel d'offres : le demandeur veut un document unique, dans l'ordre qu'il a listé. La fusion elle-même prend quelques secondes. Ce qui se passe mal, c'est l'ordre, les formats de page et le fichier qui perd silencieusement sa signature — tout cela évitable si l'on sait où ça mord.ExplicationUne signature dessinée est une vraie signature — mais pas une signature qualifiéeDessiner son nom sur un PDF produit une signature électronique simple. Le droit européen dit qu'on ne peut pas l'écarter au seul motif qu'elle est électronique — et aussi qu'elle ne porte aucune des présomptions d'une signature qualifiée. Savoir de quel niveau on dispose fait la différence entre un document qui tient et un document qu'il faudra défendre.GuideDébranche : quels outils de fichiers en ligne téléversent vraiment ton documentTous les outils de fichiers en ligne promettent que ton document est en sécurité. Presque aucun ne dit s'il quitte ta machine. Il existe un test de cinq secondes qui tranche sans lire une seule politique de confidentialité, et il marche sur n'importe quel outil — y compris celui-ci.TutorielNuméroter un PDF quand les pages sont pivotées ou de formats différentsNuméroter un document bien rangé est trivial. Ce qui mord, c'est une page couchée, une feuille Letter au milieu de A4, un fichier d'impression avec fond perdu, et un document qui imprime déjà son propre numéro. Les quatre ont été testés : sur les trois premiers le numéro se pose exactement où tu l'as demandé, et le quatrième n'est pas détecté du tout.

Outils similaires

Le comportement décrit ici pour les outils de ce site a été lu dans leur code source le 13 août 2026 et mesuré sur les bibliothèques qu'ils embarquent. Le comportement d'un tableur dépend de la version, de la build et des paramètres régionaux de la machine devant toi — Microsoft a changé plusieurs de ces valeurs par défaut, alors vérifie les vôtres plutôt que de croire un article, celui-ci compris.

Sources

Tu as repéré une erreur dans cet article ?