Unsichtbare Zeichen im Text finden und entfernen

Füg Deinen Text ein, und ASKI markiert die Zeichen, die da nicht hingehören: unsichtbare Steuerzeichen wie den Zero-Width Space, fremde Buchstaben, die wie deutsche aussehen, und typografische Zeichen, die auf keiner deutschen Tastatur liegen. Zu jedem Fund siehst Du, worum es sich handelt. Ein Klick ersetzt sie durch saubere Tastaturzeichen.

Dein Text verlässt Deinen Browser nicht. ASKI prüft alles auf Deinem Rechner, lädt nichts hoch und speichert nichts. Der Quelltext dieser Seite ist lesbar geblieben, damit Du das nachprüfen kannst.

Solche Zeichen sammeln sich beim Kopieren aus Chats, Webseiten, PDFs und Office-Dateien an. Sehen kannst Du sie nicht, aber sie brechen die Suche nach Wörtern und sorgen dafür, dass Datensätze beim Import nicht mehr zusammenfinden.

Dein Text bleibt auf deinem Rechner. ASKI lädt nichts hoch und speichert nichts.

0 Zeichen

0Zeichen gesamt
0Funde
0Zeichen-Typen
Fundstellen
Alle Funde im Detail

Zeigt der Text maschinelle Stilmuster?

wenig auffällig
gemischtes Bild
auffällig

Der Stil-Hinweis ist ein Experiment. Er zeigt Muster, keine Beweise. Was er kann und was nicht, steht unter Kann ASKI beweisen, dass ein Text von einer KI stammt?

Was ist ein Zero-Width Space?

Ein Zero-Width Space (U+200B) ist ein Unicode-Zeichen ohne sichtbare Breite. Im Text ist es unsichtbar, zählt aber als Zeichen: Es bricht die Suche nach Wörtern und kann Formulare und Datenimporte stören. Auch die Zeichenzählung stimmt dann nicht mehr. Zero-Width-Zeichen entstehen meist beim Kopieren aus Chat-Oberflächen oder PDFs.

Woran erkenne ich Homoglyphen?

Homoglyphen sind Zeichen, die gleich aussehen, aber verschiedene Codepoints haben. Ein kyrillisches a (U+0430) ist von einem lateinischen a (U+0061) mit bloßem Auge nicht zu unterscheiden. Homoglyphen brechen Suche und Sortierung, und sie werden für getarnte Adressen in Phishing-Mails genutzt.

Zum Vergleich nebeneinander: kyrillisch а und lateinisch a. ASKI unterscheidet sie am Codepunkt.

Warum enthalten KI-Texte oft Geviertstriche?

Sprachmodelle setzen bevorzugt typografisch korrekte Zeichen: den Geviertstrich (U+2014), typografische Anführungszeichen (U+201E und U+201C) und das Ellipsen-Zeichen (U+2026). Auf einer deutschen Tastatur sind diese Zeichen nicht direkt erreichbar, deshalb tippt sie kaum jemand von Hand. Ihre Häufung ist eines der deutlichsten Anzeichen für unbearbeiteten KI-Text.

Zum Wiedererkennen:

Was ist ein Soft Hyphen und warum stört er?

Ein Soft Hyphen (U+00AD) ist ein Trennstrich, der nur am Zeilenumbruch sichtbar wird. Beim Kopieren wandert er unsichtbar mit. In Artikelnummern oder Suchbegriffen führt er dazu, dass identisch aussehende Werte nicht mehr übereinstimmen.

Was sind Bidi-Steuerzeichen?

Bidi-Steuerzeichen steuern die Schreibrichtung, etwa für arabische oder hebräische Textteile. In rein deutschem Text haben sie nichts zu suchen. Sie sind unsichtbar und können die Anzeigereihenfolge verändern, was sich zum Verschleiern von Dateinamen und Adressen missbrauchen lässt.

Was ist ein geschütztes Leerzeichen?

Ein geschütztes Leerzeichen (U+00A0) verhindert den Zeilenumbruch zwischen zwei Wörtern. Es sieht aus wie ein normales Leerzeichen, ist aber ein anderes Zeichen. In CSV-Dateien und Datenbankfeldern führt das zu Werten, die gleich aussehen und trotzdem nicht gefunden werden.

Warum stören unsichtbare Zeichen in Artikeldaten und CSV-Importen?

Unsichtbare Zeichen in Artikelnummern oder EAN führen dazu, dass Datensätze beim Import nicht zugeordnet werden. Der Wert sieht im Tabellenblatt korrekt aus, stimmt aber nicht mit dem Zielsystem überein. Typische Folgen sind doppelt angelegte Artikel, fehlgeschlagene Abgleiche zwischen Shop und Warenwirtschaft und so weiter.

Der Klassiker ist ein geschütztes Leerzeichen am Ende einer Artikelnummer, hineinkopiert aus einer Mail oder einem PDF. Im Tabellenblatt sieht die Nummer richtig aus, der Abgleich mit dem Shop findet sie trotzdem nicht. ASKI macht solche Zeichen sichtbar, bevor der Import sie zum Problem macht.

Gibt es unsichtbare Wasserzeichen in KI-Texten?

Einzelne Anbieter arbeiten mit statistischen Wasserzeichen im Wortwahl-Muster, nicht mit versteckten Zeichen. Solche Muster kann kein Werkzeug von außen prüfen, nur der Anbieter selbst mit seinem Schlüssel. Was sich prüfen lässt, sind unsichtbare Unicode-Zeichen, die beim Kopieren aus Chat-Oberflächen mitwandern.

Werden meine Texte hochgeladen oder gespeichert?

Nein. ASKI prüft Deinen Text im Browser auf Deinem Rechner. Es gibt keinen Server dahinter, Dein Text bleibt bei Dir.

Ist ASKI kostenlos?

Ja, ohne Anmeldung und ohne Limit. Ich habe ASKI für meine eigene Arbeit gebaut und stelle es hier frei zur Verfügung.

Kann ASKI beweisen, dass ein Text von einer KI stammt?

Nein. Der Stil-Hinweis zählt Muster, die in maschinellem Text gehäuft vorkommen, mehr nicht. Ein sorgfältig überarbeiteter KI-Text bleibt unauffällig, und ein sehr förmlicher menschlicher Text kann Muster zeigen. Als Beweis taugt das nicht, als Anlass zum genauen Hinsehen schon.

Funktioniert das auch mit englischem Text?

Die Zeichenprüfung ja, sie arbeitet unabhängig von der Sprache. Der Stil-Hinweis ist auf deutsche Texte ausgelegt, bei englischen sagt er weniger aus.

Was passiert beim Bereinigen genau?

ASKI ersetzt typografische Zeichen durch ihre Tastatur-Entsprechung und macht aus Homoglyphen wieder lateinische Buchstaben. Unsichtbare Zeichen entfallen ersatzlos. Die Fundliste zeigt vorher zu jedem Fund, was beim Bereinigen mit ihm passiert.

Warum sind solche Zeichen überhaupt in meinem Text?

Meist durch Kopieren. Chats, Webseiten, PDFs und die Autokorrektur von Office-Programmen setzen typografische und unsichtbare Zeichen ein, ohne dass Du es merkst. Beim Weiterkopieren wandern sie mit.