Aller au contenu
OneKitly

Le nombre 1 et le texte « 1 » ne sont pas des doublons

Publié le 01/09/2026 · 4 min de lecture · Outils fichiers

Daniel Okonkwo

Daniel OkonkwoDéveloppeur front-end et rédacteur Tech chez OneKitly

Performance web · Formats de fichiers

Vérifié à partir de 3 sources

Voir le profil
En bref

L'outil garde la première occurrence de chaque ligne distincte et écarte les suivantes, en comparant le tuple complet des cellules plutôt qu'une colonne clé — deux clients au même nom mais d'adresses différentes survivent donc tous les deux, ce qui est bien ce qu'on veut. Ce qui surprend, c'est que la comparaison est exacte et typée. Passée sur cinq lignes qui s'affichent toutes « 1, a » — le nombre 1, le texte « 1 », le nombre à nouveau, le même nombre écrit 1.0, et le texte « 1 » précédé d'une espace — elle en laisse trois : le nombre, le texte simple et le texte espacé sont trois lignes différentes, tandis que 1 et 1.0 sont le même nombre et se replient. Ce n'est pas un défaut : c'est la seule comparaison qui ne peut pas fusionner en silence deux enregistrements qui diffèrent. Elle implique qu'une colonne importée en texte depuis un fichier et en nombres depuis un autre ne se dédoublonnera pas contre elle-même, et le correctif est en amont : rends la colonne d'un seul type avant de fusionner, pas après.

Le dédoublonnage compare des lignes entières à l'identique, type de cellule compris. Cinq lignes d'apparence identique en ont donné trois : l'une portait un nombre, l'autre une chaîne, la troisième une chaîne précédée d'une espace.

D'où viennent les types mélangés

Presque toujours d'un import. Un CSV n'a aucun type — chaque champ est du texte jusqu'à ce que quelque chose en décide autrement — donc le programme qui l'a ouvert a deviné, et il devine différemment selon les premières lignes de la colonne, la locale, et selon qu'une valeur porte un zéro initial ou un signe monétaire. Les numéros de référence en sont la victime habituelle : 00412 est du texte dans un fichier parce que le zéro doit être conservé, et le nombre 412 dans un autre parce que cela avait l'air numérique. Fusionne les deux et la même référence fait deux lignes.

L'autre source, ce sont les espaces invisibles. Une espace finale survit à un copier-coller depuis une page web, un PDF ou un courriel, et elle rend différentes deux cellules par ailleurs identiques pour toute comparaison exacte — le dédoublonnage ici, mais aussi les recherches, les jointures et les tableaux croisés partout ailleurs. Le nettoyage est un rechercher-remplacer avant la fusion, et il vaut d'être fait sur toute colonne sur laquelle tu comptes rapprocher.

Des lignes entières, pas une colonne clé

Comparer la ligne entière est le choix prudent, et il vaut d'être compris comme tel. Deux lignes qui s'accordent sur le numéro de référence mais diffèrent par un champ d'adresse sont gardées, parce que l'outil ne peut pas savoir laquelle des deux adresses est à jour — en décider est un jugement sur tes données, pas une opération dessus. Si tu veux dédoublonner sur une seule colonne, trie d'abord par cette colonne et retire les surplus toi-même ; le résultat est le même et la décision reste la tienne. La ligne d'en-tête n'est jamais tenue pour un doublon de quoi que ce soit : un fichier dont la première ligne répète une valeur du corps garde les deux.

Cinq lignes qui s'affichent toutes « 1, a » — trois survivent
Cellule telle qu'enregistréeGardée ou retiréePourquoi
nombre 1GardéePremière occurrence
texte « 1 »GardéeUne chaîne n'est pas un nombre
de nouveau le nombre 1RetiréeIdentique à la première ligne
nombre 1.0RetiréeLe même nombre écrit autrement
texte « 1 » avec une espaceGardéeUne chaîne différente
Supprimer les lignes en doubleSupprime les lignes identiques à une précédente, en gardant l'en-tête et la première occurrence. Fonctionne avec Excel (XLSX, XLS, XLSM, XLSB), OpenDocument (ODS), Apple Numbers, CSV et TSV.Essayer l'outil

Questions fréquentes

Lequel des doublons est conservé ?
Le premier du fichier, dans l'ordre où les lignes apparaissent. Tout ce qui suit est écarté. Si les lignes diffèrent par une colonne à laquelle tu n'as pas pensé, celle qui reste est la plus ancienne, pas la meilleure — donc si la fraîcheur compte, trie la feuille avant de dédoublonner et non après.
Comment rendre une colonne mélangée d'un seul type ?
Décide de ce qu'est réellement la colonne et convertis-la entièrement en une seule opération avant de fusionner. Numéros de référence, codes postaux et numéros de téléphone sont du texte — ils ont des zéros initiaux et ne s'additionnent jamais. Montants et effectifs sont des nombres. Dans un tableur, formate la colonne, puis passe par une conversion en colonnes ou une colonne d'appoint avec TEXTE ou CNUM pour forcer chaque cellule ; le format seul ne change pas ce qui est enregistré.
Regarde-t-il d'une feuille à l'autre du classeur ?
Il travaille sur une feuille à la fois, ce qui est ce qu'on veut quand les onglets portent des choses différentes. Pour dédoublonner à travers plusieurs fichiers ou onglets, fusionne-les d'abord en une seule feuille — la fusion en lignes empile les lignes de chaque fichier dans un tableau unique et ne garde que le premier en-tête — puis lance ceci sur le résultat.

Articles qui pourraient t'intéresser

Tous les guides
ExplicationConvertir les formules en valeurs garde la réponse en cache, pas le calculUn fichier de tableur range à la fois la formule et la dernière réponse calculée par Excel. Retirer la formule laisse la réponse enregistrée — et laisse un vide partout où le fichier n'en portait pas.ComparatifXLS, XLSX, XLSM et XLSB : lequel est lequel, et lequel te faut-ilQuatre extensions, dont trois sont la même boîte avec des couvercles différents. Renomme un XLSX en .zip et il s'ouvre — ce seul fait explique toute la famille, et explique pourquoi XLS, qui ne s'ouvre pas ainsi, reste celui qui pose problème.ExplicationPourquoi ton CSV casse les accents et les dates dans ExcelTrois pannes totalement différentes se cachent derrière la même phrase. L'une est l'encodage, l'autre le séparateur, la troisième Excel qui devine des types en ouvrant le fichier — et le remède diffère pour chacune. Voici comment les distinguer en cinq secondes.TutorielExtraire le texte d'un PDF, et ce que la mise en page lui faitUn PDF stocke des glyphes à des coordonnées — pas des lignes, pas des paragraphes, pas un ordre de lecture. L'extraction reconstruit le texte à partir de ces positions : c'est pourquoi deux colonnes ressortent entrelacées, un tableau perd ses cellules, et un scan ne donne rien du tout. Mesuré en exécutant l'outil.TutorielSRT vers texte : obtenir une transcription propre à partir de sous-titresRetirer les numéros et les horodatages, c'est la moitié facile. Celle qui décide de la lisibilité, ce sont les balises d'italique, les tirets de dialogue, les descriptions sonores et les phrases coupées sur deux sous-titres — et ce convertisseur t'les laisse toutes.ComparatifZIP ou TAR : lequel choisir, et pourquoi cela change toutUne seule différence de structure explique tout le reste : TAR ne compresse pas, il empile ; ZIP compresse chaque fichier séparément. Mesuré sur 60 petits fichiers source, cela fait 1 809 octets contre 14 686.

Outils similaires

Sources

Tu as repéré une erreur dans cet article ?