TanodTools
RU

Текст в двоичный код

Превратите текст в двоичный код или расшифруйте двоичный код обратно в читаемый текст. Работает с любыми языками и эмодзи.

Работает полностью в браузере

Преобразование

Введите текст, чтобы начать.

Для кодирования текст до 1 МБ, для расшифровки двоичный код до 5 МБ. Результат обновляется по мере ввода.

Как преобразовать текст в двоичный код

  1. Выберите Текст в двоичный код или Двоичный код в текст.
  2. Введите или вставьте данные в поле. Результат появляется по мере ввода.
  3. Скопируйте результат или скачайте его как файл .txt. Кнопка Обратить преобразует результат обратно.

Как текст превращается в единицы и нули

Компьютеры хранят текст в виде чисел. Кодировка определяет, какое число получает каждый символ; этот инструмент использует UTF-8, которую применяют почти все веб-страницы, письма и современные файлы. UTF-8 хранит первые 128 символов (английский алфавит, цифры и распространённые знаки препинания) по одному байту каждый, с теми же значениями, что и в более старой кодировке ASCII. Остальные символы занимают от двух до четырёх байтов: é — это 11000011 10101001, а эмодзи 😀 — четыре байта.

Байт — это восемь бит, поэтому каждый байт показывается восемью двоичными цифрами, с сохранением ведущих нулей, чтобы все группы были одной ширины. Так результат легко читать обратно: каждая группа из восьми цифр — один байт.

Для расшифровки инструмент читает каждую группу как байт, а затем читает байты как текст в UTF-8. Если байты не образуют корректный UTF-8, он сообщает, где начинается проблема, вместо того чтобы показывать искажённые символы.

Советы

Вопросы и ответы

Как текст превращается в двоичный код?

Сначала каждый символ превращается в байты в кодировке UTF-8, которая используется в вебе, а затем каждый байт записывается восемью двоичными цифрами. Буква A — это байт 65, то есть 01000001. Простые английские буквы занимают по одному байту, буквы кириллицы и с диакритическими знаками — по два байта, а большинство эмодзи — четыре.

Это то же самое, что перевод из ASCII в двоичный код?

Для простых английских букв, цифр и знаков препинания да: UTF-8 даёт этим символам те же значения байтов, что и ASCII. Разница видна только для других символов, которые ASCII вообще не может представить.

Какой двоичный код можно расшифровать?

Группы из не более чем восьми нулей и единиц, разделённые пробелами, запятыми или переносами строк, по одной группе на байт, либо одну сплошную строку цифр, длина которой кратна восьми. Всё остальное, например цифра 2 или буква, сопровождается указанием позиции, чтобы вы могли это исправить.

Почему при расшифровке сообщается, что байты не являются корректным UTF-8?

Не всякая последовательность байтов является корректным текстом. Какого-то байта может не хватать или быть лишний, либо двоичный код получен из более старой кодировки или из файла, который не является текстом. В сообщении указан первый байт, который не удаётся прочитать. Проверьте, не потерялась ли какая-либо группа при копировании двоичного кода.

Что такое варианты hex, десятичный и восьмеричный?

Они записывают те же байты в другой системе счисления: hex использует две цифры 0–9 и a–f на байт (A — это 41), десятичная — числа от 0 до 255 (A — это 65), а восьмеричная — от 0 до 377 (A — это 101). Расшифровка принимает ту же систему, которую вы выбрали.

Загружается ли мой текст?

Нет. Преобразование выполняется в вашем браузере, а текст не загружается и не сохраняется.