Zum Inhalt springen
OneKitly

Nicht-ASCII-Zeichen entfernen

Entferne alle Zeichen außerhalb des Standard-ASCII-Bereichs aus deinem Text.

Nicht-ASCII-Zeichen entfernen kannst du kostenlos und beliebig oft direkt auf dieser Seite nutzen. Es steht in unserem Katalog unter Umwandeln & Bereinigen, neben Wiederholte Zeichen entfernen und Akzente entfernen.

So funktioniert's

  1. Öffne das Tool — ohne Anmeldung oder Installation.
  2. Gib deine Daten ein oder passe die verfügbaren Optionen an.
  3. Erhalte dein Ergebnis sofort und kopiere oder lade es herunter.

Häufige Fragen

Was ist Nicht-ASCII-Zeichen entfernen?

Entferne alle Zeichen außerhalb des Standard-ASCII-Bereichs aus deinem Text.

Wann brauche ich das konkret?

Eingefügten Text säubern, bevor er weitergeht: Duplikate aus einer Liste entfernen, Groß-/Kleinschreibung vereinheitlichen, Akzente für einen Dateinamen entfernen oder Zeilen sortieren.

Was ist der häufigste Fehler?

Text sortieren, als wäre er ASCII. Akzentbuchstaben landen bei Byte-Sortierung hinter dem Z, wodurch „Zürich“ vor „Émile“ steht — eine Liste, die kein Leser akzeptiert.

Worin unterscheidet sich Nicht-ASCII-Zeichen entfernen von Wiederholte Zeichen entfernen?

Sie liegen nah beieinander, beantworten aber verschiedene Fragen: Wiederholte Zeichen entfernen ist das richtige, wenn es darum geht, reduziere Folgen desselben Zeichens auf eins (helllo → helo). Nimm das, was zu deinem Ausgangspunkt passt — beide sind kostenlos.

Gibt es ein Werkzeug für den nächsten Schritt?

Akzente entfernen ist das nächstliegende danach: Entferne Akzente und diakritische Zeichen: é wird zu e, ü zu u.

Was lohnt sich sonst noch daneben offen zu haben?

Leerzeilen entfernen und Doppelte Zeilen entfernen — sie tauchen in derselben Aufgabe oft genug auf, um einen zweiten Tab zu verdienen.

Woher stammen die Daten?

Die Transformationen nutzen die Unicode-fähige Stringverarbeitung des Browsers — Groß-/Kleinschreibung und Sortierung folgen der Locale, nicht der Byte-Reihenfolge. Nichts wird gekürzt.

Zum Weiterlesen

Alle Ratgeber
ErklärungAkzente entfernen zerstört die Suche — bis du es auf beiden Seiten tustDiakritika zu falten ist ein Normalisierungsschritt, und Normalisierung wirkt nur, wenn dieselbe Funktion über Index und Suchanfrage läuft. NFC gegen NFD mit offengelegten Codepunkten und die Buchstaben — ø, ł, ß, œ, ı —, die den Faltvorgang unverändert überstehen.ErklärungEmoji sind schwerer, als sie aussehen: warum es für „einfach die Emoji entfernen“ keine Einzeiler-Antwort gibtEin sichtbares Emoji kann ein Codepunkt sein oder vierzehn UTF-16-Einheiten. Wir haben drei verbreitete reguläre Ausdrücke auf einen echten Satz losgelassen, und jeder ist anders gescheitert — einer löschte die Ziffern. Hier steht, warum, welche Unicode-Eigenschaft welche Frage beantwortet, und welche Graphemcluster-Regel wirklich funktioniert.AnleitungUnsauberen Text bereinigen: die Reihenfolge der Schritte, auf die es ankommtTags entfernen, bevor Entitäten dekodiert werden, trimmen vor dem Deduplizieren, Leerraum zuletzt zusammenfassen. Drei Reihenfolgen in Node ausgeführt, eine neunstufige Pipeline in der richtigen Abfolge und die unsichtbaren Zeichen — U+00A0, U+200B, U+FEFF — die jede naive Bereinigung überleben.ErklärungDie Sprache eines Textes erkennen — und warum kurze Texte scheiternGemessen, nicht behauptet: 90 kurze echte Wendungen in sechs Sprachen, keine abgelehnt und 68 richtig — 76 %, unter sechzehn Buchstaben nur noch 64 %. Vier der falschen Antworten kamen mit 100 % Sicherheit zurück.ErklärungSatz- und Titelschreibweise: Die Regeln unterscheiden sich je nach SpracheDie englische Titelschreibweise hat je nach Stilhandbuch drei verschiedene Grenzen. Französisch, Spanisch, Portugiesisch und Italienisch haben gar keine. Deutsch schreibt jedes Substantiv groß. Das Werkzeug weiß von all dem nichts — hier steht genau, was es tut.AnleitungZeilen nach einem Muster filtern — ohne KommandozeileDas ist grep für Menschen, die grep nicht benutzen — mit einem wichtigen Unterschied: Gesucht wird eine reine Teilzeichenkette, ein echter regulärer Ausdruck liefert also ein leeres Feld und keine Fehlermeldung. Jede Aussage hier wurde durch Ausführen des Werkzeugs geprüft.