Une URL en fin de phrase garde le point ; une adresse e-mail en fin de la même phrase, non. Un prénom accentué dans une adresse revient tronqué. Chaque cas a été passé dans les outils et la sortie exacte est reproduite.
Trois commandes se cachent derrière trois boutons : une image à un instant donné, un nombre fixe réparti sur le clip, ou une toutes les N secondes. Voici les arguments exacts, le plafond de 60 images et la raison pour laquelle une image prise au milieu d'un clip compressé ne sera jamais aussi nette qu'une image-clé.
Il existe deux façons radicalement différentes de faire pivoter une vidéo, et une seule touche à l'image. Cet outil prend la voie lente, avec perte et universelle — et il y a de bonnes chances que ton clip de téléphone couché n'en ait pas besoin du tout.
La casse de titre anglaise a trois seuils différents selon le guide de style. Le français, l'espagnol, le portugais et l'italien n'en ont aucun. L'allemand capitalise chaque nom. L'outil n'en sait rien — voici exactement ce qu'il fait.
C'est grep pour ceux qui n'utilisent pas grep, avec une différence de taille : la recherche est une sous-chaîne littérale, si bien qu'une vraie expression régulière renvoie une zone vide sans message d'erreur. Chaque affirmation a été vérifiée en exécutant l'outil.
Deux lignes qui paraissent identiques ne le sont souvent pas. La casse, une espace finale, une espace insécable et deux encodages différents de la même lettre accentuée ont été passés dans le détecteur de doublons : il n'en a signalé aucun dans trois cas sur quatre.
Un collage transporte des caractères invisibles : espaces insécables, traits d'union conditionnels, espaces de largeur nulle, tabulations et CRLF. Quatre outils de nettoyage ont été passés sur chacun, et ils utilisent trois définitions différentes de l'espace.
Le chiffrement est la moitié facile. Voici exactement ce que l'outil fait à ton fichier — algorithme, dérivation de clé, sel, nonce — et pourquoi une pièce jointe chiffrée avec le mot de passe dans le même fil ne protège rien du tout.
Remplacer les noms par des identifiants ne fait pas sortir une base du RGPD — l'article 4, point 5, et le considérant 26 le disent directement. Des données réellement synthétiques sont, elles, hors du champ du règlement. Cette seule distinction décide de la façon dont tu alimentes un environnement de préproduction.
Le sous-titre 12 de la piste anglaise n'est pas le sous-titre 12 de la piste française, parce que les traducteurs découpent et regroupent les phrases autrement. Deux stratégies existent pour les apparier ; ce fusionneur n'en applique aucune — il entrelace. Voici ce que cela donne et quand cela suffit.
Mesure l'écart en deux points au lieu de le deviner une fois. S'il est constant, un seul décalage corrige le fichier. S'il grandit, c'est un problème de cadence — 25 ips contre 23,976 dérive de 2,5625 seconde par minute — et aucun décalage ne le corrigera.
Retirer les numéros et les horodatages, c'est la moitié facile. Celle qui décide de la lisibilité, ce sont les balises d'italique, les tirets de dialogue, les descriptions sonores et les phrases coupées sur deux sous-titres — et ce convertisseur t'les laisse toutes.
Une virgule est protégée, un guillemet est doublé, et un sous-titre sur deux lignes garde ses deux lignes — vérifié à l'octet près sur trois allers-retours consécutifs. Ce qui peut encore altérer ton fichier, c'est le tableur au milieu.
Luhn est une somme de contrôle pour attraper les fautes de frappe, brevetée en 1960, et c'est tout son travail. Un numéro qui la passe ne te dit rien d'aucun compte. Pour tester une intégration de paiement, il te faut les numéros publiés par ton prestataire, pas un numéro généré.
La validité d'une signature dessinée se règle ailleurs. Ce qui décide si ton document est réellement signé, c'est l'ordre dans lequel tu sollicites les signataires, ce que consigne la piste d'audit, et six modes de défaillance qui n'ont rien de juridique.
La RFC 8259 n'impose l'échappement que de trois choses dans une chaîne JSON. Tout le reste est facultatif. Celle qui casse réellement les chaînes de traitement est le demi-surrogate isolé : légal dans un texte JSON, impossible en UTF-8, et remplacé en silence dès que tes données sont écrites.
La plus petite chose qui soit encore un tableau tient en deux lignes : une ligne d'en-tête et une ligne de séparation. Voici pourquoi la seconde est obligatoire en GitHub Flavored Markdown, où les tableaux à barres n'existent pas du tout, et ce qu'un générateur fait que la saisie manuelle ne peut pas faire.
Un tableau Markdown n'interdit que deux caractères dans une cellule : la barre verticale et le saut de ligne. Voici ce que fait chacun, comment un convertisseur les traite, pourquoi l'échappement doit être appliqué dans le bon ordre, et pourquoi l'alignement du source ne compte jamais.
Pourquoi la langue du lecteur décide du délimiteur, ce que le convertisseur fait aux guillemets quand tu changes, ce qu'est réellement la première ligne sep=, et le nombre de cellules citées sur le même export écrit de cinq façons.
Ce qu'il advient de la ligne d'en-tête, des lignes de longueurs inégales, des types — et la seule chose pour laquelle on confond régulièrement la transposition et qu'elle ne sait pas faire.
Deux documents qui ne diffèrent que par le nombre d'enfants produisent deux formes JSON différentes, et aucun convertisseur ne peut les distinguer sans schéma. Plus ce que celui-ci fait réellement des attributs, du contenu mixte et des espaces — et la seule chose qu'il ne sait toujours pas consigner.
Délimiteurs entre guillemets, sauts de ligne intégrés, types ambigus, en-têtes en double et encodage. Chaque cas a été passé dans le convertisseur et la sortie exacte est reproduite ici — y compris les deux qu'il ne rattrape pas.
Les deux mêmes commandes ressortent sur cinq colonnes d'un convertisseur et dix d'un autre, et aucun n'a tort. Chemins pointés, tableaux de scalaires, tableaux d'objets et enregistrements aux clés différentes : quatre décisions, prises à ta place, le plus souvent en silence.
Retirer des balises et assainir du HTML sont deux métiers différents. Un fragment réel passé dans une regex naïve puis dans un nettoyeur conscient de la mise en forme, avec le contenu des script et style, les coupures de blocs, les commentaires, les CDATA et l'ordre des entités montrés en sortie.