Перейти к содержанию
TextArray
100% локально

Двоичный код в текст и обратно

Преобразуйте текст в двоичный код и обратно в текст, шаг за шагом.

Входные данные

Двоичный код в текст и обратно

Двоичный формат — это то, как компьютер фактически хранит текст: каждый символ становится одним или несколькими байтами, а каждый байт — восемью битами. Вставьте предложение, чтобы увидеть стоящие за ним нули и единицы, или вставьте двоичную строку и прочитайте сообщение обратно. Направление выбирается за вас — ввод, состоящий только из 0, 1 и разделителей, декодируется, все остальное кодируется — и результат обновляется по мере ввода.

Автоопределение — это предположение, и один случай действительно неоднозначен: строка цифр, например 1010, считывается как код и декодируется в символ. Если вы имели в виду сами четыре цифры, установите направление текста в код, и вместо этого вы получите их двоичный код. Для этого и нужен переключатель направления.

Разделитель формирует вывод. Пространство между байтами — это читаемое значение по умолчанию, которое выдает большинство двоичных трансляторов. Отсутствие разделителя дает непрерывную битовую строку, используемую в форматах файлов и документации протоколов. Пользовательский разделитель принимает все, что вы вводите — запятую, тире или \\n, чтобы поместить один байт в строку. Переключите систему счисления на восьмеричную, и каждый байт станет трехзначным от 000 до 377. Обозначение, используемое в chmod, старых инструментах Unix и \\nnn, экранируется в строках C. UTF-8 охватывает каждый символ, поэтому буква с акцентом стоит два байта, а эмодзи — четыре; ASCII — это строгий 7-битный набор, который отвергает все, что выше кода 127, вместо того, чтобы незаметно записывать неправильные байты.

Обратное чтение кода намеренно терпимо, потому что настоящий двоичный файл приходит в беспорядке. Пробелы и разрывы строк игнорируются, префиксы 0b и 0o отбрасываются, а группа из семи цифр дополняется обратно в байт. О случайных буквах сообщается, а не пропускается, поэтому поврежденная вставка никогда не отвечает правдоподобным неправильным словом. Все работает в вашем браузере и ничего не загружается.

FAQ

Почему 1010 превращается в букву, а не в двоичную систему?
Поскольку строка, состоящая только из 0 и 1, выглядит точно так же, как код, автоматическое определение декодирует ее. Установите направление «Текст в код», и вы получите двоичный код самих цифровых символов.
В чем здесь разница между UTF-8 и ASCII?
UTF-8 кодирует каждый символ, используя один байт для обычного ASCII, два для буквы с диакритическим знаком и четыре для эмодзи. ASCII охватывает только коды 0–127, поэтому все, что выше этого значения, считается ошибкой, а не преобразуется в вводящие в заблуждение байты.
Какие двоичные форматы он может читать?
Разнесенные байты, непрерывная битовая строка, байты с префиксом 0b и группы, разбитые на любое количество строк. Запятые, тире и каналы работают как границы байтов, если вы установите направление «Кодировать в текст». Группа из семи цифр дополняется до восьми, что восстанавливает выходные данные трансляторов, в которых отбрасываются ведущие нули.
Для чего нужен восьмеричный режим?
Octal записывает каждый байт как три цифры от 000 до 377. Вы встретите его в разрешениях файлов Unix, в escape-последовательностях \nnn внутри строк C и оболочки, а также в старых дампах, где три цифры на байт были более компактными, чем восемь.
Мой текст где-нибудь загружен?
Нет. Преобразование выполняется полностью в вашем браузере, и ваш текст никогда не покидает ваше устройство.