Ukryte znaki w tekście
Ukryte znaki to punkty kodowe Unicode niewidoczne, ale obecne w tekście: spacje zerowej szerokości, znaki sterujące kierunkiem, nietypowe spacje i znaki sterujące. Psują porównywanie ciągów, wyszukiwanie, importy danych, a w kodzie mogą sprawić, że to, co widzisz, różni się od tego, co się wykonuje.
Więcej: co znaleziono, widok rentgenowski i opcje
Widok rentgenowski
Twój tekst z każdym ukrytym znakiem pokazanym jako etykieta. Najedź, aby zobaczyć nazwę Unicode.
Co znaleziono
| Punkt kodowy | Znak | Liczba | Działanie |
|---|
Główne klasy
- Zerowa szerokość (U+200B, U+200C, U+2060…): bez szerokości, dzielą słowa niewidocznie dla wyszukiwania i regex.
- Znaki sterujące kierunkiem (U+202A–U+202E, U+2066–U+2069): zmieniają kolejność wyświetlania bez zmiany zapisanego tekstu. Najbardziej ryzykowna klasa w kodzie.
- Nietypowe spacje (U+00A0, U+202F, U+3000…): wyglądają jak zwykłe spacje, ale to inne znaki, i psują kolumny CSV oraz wcięcia.
- Znaki sterujące (bloki C0/C1): pozostałości danych binarnych lub błędnych dekodowań, psujące CSV, TSV i logi.
Skąd się biorą
Prawie nigdy nie są celowymi znakami. Pojawiają się na drodze kopiowania: edytory CMS, eksporty PDF, edytory tekstu, dobrze złożone strony i arkusze. Tekst AI zbiera je z interfejsu czatu, nie z modelu.
Jak je usunąć bez uszkodzenia tekstu
Narzędzie powyżej czyta tekst punkt kodowy po punkcie kodowym: usuwa niewidoczne, zastępuje dziwne spacje zwykłymi (nigdy ich nie kasuje, by nie skleić słów) i zachowuje emoji, pismo perskie, koreańskie, khmerskie i Braille'a. Każdy znak widzisz w widoku rentgenowskim przed czyszczeniem.
Częste pytania
Czy brak ukrytych znaków dowodzi, że tekst nie jest z AI?
Nie, i odwrotność też jest fałszywa. Ukryte znaki wskazują drogę kopiowania, nie autorstwo w żadną stronę.
Dlaczego są groźne w kodzie?
Znak sterujący kierunkiem może sprawić, że komentarz zdaje się kończyć tam, gdzie się nie kończy, podczas gdy kompilator widzi co innego niż ty.