Aller au contenu
OneKitly

Supprimer les caractères non-ASCII

Supprime tous les caractères hors de la plage ASCII standard de ton texte.

Supprimer les caractères non-ASCII s'utilise gratuitement, autant de fois que tu veux, directement depuis cette page. Il est rangé sous Transformer & nettoyer dans notre catalogue, aux côtés de Supprimer les caractères répétés et Supprimer les accents.

Comment l'utiliser

  1. Ouvre l'outil — sans inscription ni installation.
  2. Saisis tes données ou ajuste les options disponibles.
  3. Obtiens ton résultat instantanément, puis copie-le ou télécharge-le.

Questions fréquentes

Qu'est-ce que Supprimer les caractères non-ASCII ?

Supprime tous les caractères hors de la plage ASCII standard de ton texte.

Dans quels cas s'en sert-on concrètement ?

Nettoyer un copier-coller avant de le réutiliser : dédoublonner une liste, uniformiser la casse, retirer les accents pour un nom de fichier, ou trier des lignes.

Quelle est l'erreur la plus fréquente ?

Trier du texte comme s'il était en ASCII. Les lettres accentuées se retrouvent après le Z dans un tri par octets, ce qui place « Zurich » avant « Émile » et donne une liste qu'aucun lecteur n'acceptera.

En quoi Supprimer les caractères non-ASCII diffère-t-il de Supprimer les caractères répétés ?

Ils se ressemblent mais répondent à des questions différentes : Supprimer les caractères répétés est celui à ouvrir lorsqu'il s'agit de réduis les répétitions d'un même caractère à un seul (helllo → helo). Choisis celui qui correspond à ton point de départ — les deux sont gratuits.

Existe-t-il un outil pour l'étape suivante ?

Supprimer les accents est le plus proche après celui-ci : Supprime les accents et diacritiques d'un texte : é devient e, ü devient u.

Quels autres outils vaut-il la peine d'ouvrir à côté ?

Supprimer les lignes vides et Supprimer les lignes en double — ils reviennent assez souvent dans la même tâche pour mériter un second onglet.

D'où viennent les données ?

Les transformations s'appuient sur la gestion Unicode du navigateur : changements de casse et tri respectent donc la locale, pas l'ordre des octets. Rien n'est tronqué : ce qui sort est l'intégralité de ce qui est entré.

Pour aller plus loin

Tous les guides
ExplicationRetirer les accents casse la recherche — tant que tu ne le fais pas des deux côtésReplier les diacritiques est une étape de normalisation, et une normalisation ne fonctionne que si la même fonction s'applique à l'index et à la requête. NFC contre NFD avec les points de code affichés, et les lettres — ø, ł, ß, œ, ı — qui sortent du repli intactes.ExplicationLes emoji sont plus difficiles qu'ils n'en ont l'air : pourquoi « il suffit de les retirer » n'a pas de réponse en une ligneUn emoji visible peut valoir un point de code ou quatorze unités UTF-16. Nous avons lancé trois expressions régulières répandues sur une vraie phrase : chacune a cassé différemment, l'une a supprimé les chiffres. Voici pourquoi, quelle propriété Unicode répond à quelle question, et la règle de groupes de graphèmes qui marche vraiment.TutorielNettoyer un texte en désordre : l'ordre des opérations qui compte vraimentRetirer les balises avant de décoder les entités, couper les espaces avant de dédupliquer, écraser les blancs en dernier. Trois ordres exécutés dans Node, un pipeline de neuf étapes dans le bon sens, et les caractères invisibles — U+00A0, U+200B, U+FEFF — qui survivent à tout nettoyage naïf.ExplicationDétecter la langue d'un texte, et pourquoi les textes courts échouentMesuré, pas affirmé : 90 phrases courtes réelles dans six langues, aucune refusée et 68 justes — 76 %, tombant à 64 % en dessous de seize lettres. Quatre des réponses fausses sont revenues avec 100 % de confiance.ExplicationCasse de phrase et casse de titre : les règles changent selon la langueLa casse de titre anglaise a trois seuils différents selon le guide de style. Le français, l'espagnol, le portugais et l'italien n'en ont aucun. L'allemand capitalise chaque nom. L'outil n'en sait rien — voici exactement ce qu'il fait.TutorielFiltrer des lignes selon un motif, sans ligne de commandeC'est grep pour ceux qui n'utilisent pas grep, avec une différence de taille : la recherche est une sous-chaîne littérale, si bien qu'une vraie expression régulière renvoie une zone vide sans message d'erreur. Chaque affirmation a été vérifiée en exécutant l'outil.