Перейти к содержанию

Выход из Юникода

Преобразуйте символы в escape-символы \uXXXX и декодируйте их обратно в текст.

Входные данные

Выход из Юникода

Инструмент escape-последовательности Unicode превращает любой символ в escape-последовательность \uXXXX и декодирует эти последовательности обратно в читаемый текст. Вставьте имя с акцентами, смайлик или целый абзац, и каждый символ станет его escape-кодом из четырех hex Unicode — é станет \u00e9, а символ выше U+FFFF, например смайлик, станет суррогатной парой, например \ud83d\ude00, именно такой формы ожидает строковый литерал JavaScript, Java или JSON. Это надежный способ встраивания текста, отличного от ASCII, в исходный код, файлы конфигурации, заголовки HTTP или любой канал, который поддерживает только простой ASCII.\n\nПо умолчанию инструмент экранирует только символы выше U+007F, поэтому обычные буквы, цифры и знаки препинания остаются читаемыми, а преобразуются только символы с диакритическими знаками или нелатинские символы. Отключите «Только не-ASCII», чтобы вместо этого экранировать каждый отдельный символ, что удобно, когда вам нужна полностью запутанная или транспортно-безопасная форма. В выводе используются строчные буквы hex, соглашение, принятое в большинстве языков.\n\nРежим декодирования делает обратное. Он понимает как фиксированную форму \uXXXX, так и форму кодовой точки ES6 \u{...} — поэтому \u{1f600} декодирует эмодзи с ухмыляющимся лицом так же, как это делает \ud83d\ude00 — и оставляет любой окружающий текст нетронутым, поэтому вы можете вставить целую строку кода, и преобразуются только escape-символы. Если ничто не похоже на выход, текст просто возвращается без изменений; ошибок, которые нужно было бы сбросить, нет.\n\nВсе работает локально в вашем браузере. Ничего из того, что вы вставляете, не загружается, не отправляется на сервер и не сохраняется — преобразование происходит полностью на вашем устройстве, поэтому даже личные строки и ключи остаются с вами.

FAQ

Что такое escape-код Unicode?
Escape-код Unicode записывает символ как \u, за которым следует его четырехзначный шестнадцатеричный код, например \u00e9 для é. Он позволяет поместить любой символ в исходный код или формат данных, который принимает только простой ASCII. Символы выше U+FFFF записываются как суррогатная пара двух escape-символов \uXXXX.
Как обрабатываются смайлы?
Эмодзи располагаются над U+FFFF, поэтому кодирование превращает каждый из них в суррогатную пару — 😀 становится =ud83d\ude00. Декодирование принимает как эту пару, так и форму кодовой точки ES6 \u{1f600} и восстанавливает исходные эмодзи.
Что делает «Только не-ASCII»?
Если этот параметр включен (по умолчанию), простые буквы, цифры и знаки препинания ASCII остаются без изменений, а экранируются только символы выше U+007F, что обеспечивает читабельность вывода. Выключите его, чтобы экранировать каждый символ и получить строку, полностью состоящую только из ASCII.
Что произойдет, если я декодирую текст без escape-кодов?
Ничто не рассматривается как ошибка. Любые последовательности \uXXXX или \u{...} декодируются, а все остальное остается таким, каким оно было, поэтому текст без escape-символов возвращается без изменений.
Мой текст где-нибудь загружен?
Нет. Кодирование и декодирование полностью выполняются в вашем браузере — ничего из того, что вы вставляете, не загружается, не отправляется на сервер и не сохраняется, поэтому ваш текст никогда не покидает ваше устройство.