Aller au contenu
OneKitly

Supprimer les mots en double

Ne garde que la première occurrence de chaque mot de ton texte.

Ouvre Supprimer les mots en double et tu obtiens une réponse immédiatement, sans compte à créer. Il est rangé sous Transformer & nettoyer dans notre catalogue, aux côtés de Supprimer les lignes en double et Trier les mots par ordre alphabétique.

Comment l'utiliser

  1. Ouvre l'outil — sans inscription ni installation.
  2. Saisis tes données ou ajuste les options disponibles.
  3. Obtiens ton résultat instantanément, puis copie-le ou télécharge-le.

Questions fréquentes

Qu'est-ce que Supprimer les mots en double ?

Ne garde que la première occurrence de chaque mot de ton texte.

Dans quels cas s'en sert-on concrètement ?

Nettoyer un copier-coller avant de le réutiliser : dédoublonner une liste, uniformiser la casse, retirer les accents pour un nom de fichier, ou trier des lignes.

Quelle est l'erreur la plus fréquente ?

Trier du texte comme s'il était en ASCII. Les lettres accentuées se retrouvent après le Z dans un tri par octets, ce qui place « Zurich » avant « Émile » et donne une liste qu'aucun lecteur n'acceptera.

En quoi Supprimer les mots en double diffère-t-il de Supprimer les lignes en double ?

Ils se ressemblent mais répondent à des questions différentes : Supprimer les lignes en double est celui à ouvrir lorsqu'il s'agit de supprime les lignes répétées en gardant l'ordre d'apparition d'origine. Choisis celui qui correspond à ton point de départ — les deux sont gratuits.

Existe-t-il un outil pour l'étape suivante ?

Trier les mots par ordre alphabétique est le plus proche après celui-ci : Trie tous les mots de ton texte par ordre alphabétique.

Quels autres outils vaut-il la peine d'ouvrir à côté ?

Dupliquer chaque ligne et Trouver les lignes en double — ils reviennent assez souvent dans la même tâche pour mériter un second onglet.

D'où viennent les données ?

Les transformations s'appuient sur la gestion Unicode du navigateur : changements de casse et tri respectent donc la locale, pas l'ordre des octets. Rien n'est tronqué : ce qui sort est l'intégralité de ce qui est entré.

Pour aller plus loin

Tous les guides
GuideRechercher-remplacer : les pièges des expressions régulières, démontrés un par unGourmand contre paresseux sur la même chaîne, le point qui saute les retours à la ligne, $& et $$ dans le remplacement, une regex /g réutilisée qui saute une ligne en silence, et pourquoi /i ignore tout du i turc. Chaque échec exécuté dans Node, avec une routine compter-puis-remplacer qui les attrape.ExplicationTrouver les doublons d'une liste sans tableurDeux lignes qui paraissent identiques ne le sont souvent pas. La casse, une espace finale, une espace insécable et deux encodages différents de la même lettre accentuée ont été passés dans le détecteur de doublons : il n'en a signalé aucun dans trois cas sur quatre.ExplicationDétecter la langue d'un texte, et pourquoi les textes courts échouentMesuré, pas affirmé : 90 phrases courtes réelles dans six langues, aucune refusée et 68 justes — 76 %, tombant à 64 % en dessous de seize lettres. Quatre des réponses fausses sont revenues avec 100 % de confiance.TutorielFiltrer des lignes selon un motif, sans ligne de commandeC'est grep pour ceux qui n'utilisent pas grep, avec une différence de taille : la recherche est une sous-chaîne littérale, si bien qu'une vraie expression régulière renvoie une zone vide sans message d'erreur. Chaque affirmation a été vérifiée en exécutant l'outil.GuideNettoyer une liste collée depuis un tableur ou un PDFUn collage transporte des caractères invisibles : espaces insécables, traits d'union conditionnels, espaces de largeur nulle, tabulations et CRLF. Quatre outils de nettoyage ont été passés sur chacun, et ils utilisent trois définitions différentes de l'espace.ExplicationRetirer les accents casse la recherche — tant que tu ne le fais pas des deux côtésReplier les diacritiques est une étape de normalisation, et une normalisation ne fonctionne que si la même fonction s'applique à l'index et à la requête. NFC contre NFD avec les points de code affichés, et les lettres — ø, ł, ß, œ, ı — qui sortent du repli intactes.