Przejdź do treści

Ucieczka z Unicode

Konwertuj znaki na znaki specjalne \uXXXX i dekoduj je z powrotem na tekst.

Wejście

Ucieczka z Unicode

Narzędzie ucieczki Unicode zamienia dowolny znak w sekwencję ucieczki \uXXXX i dekoduje te sekwencje z powrotem do czytelnego tekstu. Wklej nazwę z akcentami, emoji lub cały akapit, a każdy znak stanie się jego czteroznakową zmianą w Unicode hex — é stanie się \u00e9, a znak powyżej U+FFFF, taki jak emoji, stanie się parą zastępczą, np. \ud83d\ude00, dokładnie taką, jakiej oczekuje literał ciągu JavaScript, Java lub JSON. Jest to niezawodny sposób na osadzenie tekstu innego niż ASCII w kodzie źródłowym, plikach konfiguracyjnych, nagłówkach HTTP lub dowolnym kanale, który przetrwa tylko zwykły ASCII.\n\nDomyślnie narzędzie zmienia tylko znaki powyżej U+007F, więc zwykłe litery, cyfry i znaki interpunkcyjne pozostają czytelne, a konwertowane są tylko znaki akcentowane lub znaki inne niż łacińskie. Wyłącz opcję „Tylko inne niż ASCII”, aby zamiast tego uciec od każdego pojedynczego znaku, co jest przydatne, gdy potrzebujesz całkowicie zaciemnionego lub bezpiecznego formularza. Na wyjściu używane są małe litery hex, konwencja stosowana przez większość języków.\n\nTryb dekodowania działa odwrotnie. Rozumie zarówno stałą formę \uXXXX, jak i formę punktu kodowego ES6 \u{...} — więc \u{1f600} dekoduje do emoji uśmiechniętej twarzy, tak jak robi to \ud83d\ude00 — i pozostawia otaczający tekst nietknięty, więc możesz wkleić całą linię kodu i konwertowane są tylko znaki ucieczki. Jeśli nic nie wygląda na ucieczkę, tekst po prostu wraca bez zmian; nie ma błędu do usunięcia.\n\nWszystko działa lokalnie w Twojej przeglądarce. Nic, co wkleisz, nie zostanie przesłane, wysłane na serwer ani zapisane — konwersja odbywa się całkowicie na Twoim urządzeniu, więc nawet prywatne ciągi znaków i klucze pozostają z Tobą.

Częste pytania

Co to jest ucieczka Unicode?
Funkcja ucieczki Unicode zapisuje znak jako \u, po którym następuje czterocyfrowy punkt kodowy w formacie szesnastkowym, np. \u00e9 w przypadku é. Pozwala umieścić dowolny znak w kodzie źródłowym lub formacie danych, który akceptuje tylko zwykły ASCII. Znaki powyżej U+FFFF są zapisywane jako para zastępcza dwóch znaków ucieczki \uXXXX.
Jak obsługiwane są emoji?
Emoji znajdują się nad U+FFFF, więc kodowanie zamienia każdy z nich w parę zastępczą — 😀 staje się \ud83d\ude00. Dekodowanie akceptuje zarówno tę parę, jak i formę punktu kodowego ES6 \u{1f600} i przywraca oryginalny emoji.
Co robi „Tylko inne niż ASCII”?
Po włączeniu tej opcji (ustawienie domyślne) zwykłe litery ASCII, cyfry i znaki interpunkcyjne pozostają bez zmian, a tylko znaki powyżej U+007F są pomijane, dzięki czemu wynik jest czytelny. Wyłącz tę opcję, aby uciec od każdego znaku, dając ciąg znaków składający się wyłącznie z ASCII.
Co się stanie, jeśli odkoduję tekst bez znaków ucieczki?
Nic nie jest traktowane jako błąd. Dowolne sekwencje \uXXXX lub \u{...} są dekodowane, a wszystko inne pozostaje dokładnie tak, jak było, więc tekst bez znaków ucieczki wraca bez zmian.
Czy mój tekst jest gdzieś przesłany?
Nie. Kodowanie i dekodowanie odbywa się całkowicie w przeglądarce — nic, co wklejasz, nie jest przesyłane, wysyłane na serwer ani przechowywane, więc Twój tekst nigdy nie opuszcza Twojego urządzenia.