Текст в двоичный код
Превратите текст в двоичный код или расшифруйте двоичный код обратно в читаемый текст. Работает с любыми языками и эмодзи.
Работает полностью в браузере
Введите текст, чтобы начать.
Для кодирования текст до 1 МБ, для расшифровки двоичный код до 5 МБ. Результат обновляется по мере ввода.
Как преобразовать текст в двоичный код
- Выберите Текст в двоичный код или Двоичный код в текст.
- Введите или вставьте данные в поле. Результат появляется по мере ввода.
- Скопируйте результат или скачайте его как файл .txt. Кнопка Обратить преобразует результат обратно.
Как текст превращается в единицы и нули
Компьютеры хранят текст в виде чисел. Кодировка определяет, какое число получает каждый символ; этот инструмент использует UTF-8, которую применяют почти все веб-страницы, письма и современные файлы. UTF-8 хранит первые 128 символов (английский алфавит, цифры и распространённые знаки препинания) по одному байту каждый, с теми же значениями, что и в более старой кодировке ASCII. Остальные символы занимают от двух до четырёх байтов: é — это 11000011 10101001, а эмодзи 😀 — четыре байта.
Байт — это восемь бит, поэтому каждый байт показывается восемью двоичными цифрами, с сохранением ведущих нулей, чтобы все группы были одной ширины. Так результат легко читать обратно: каждая группа из восьми цифр — один байт.
Для расшифровки инструмент читает каждую группу как байт, а затем читает байты как текст в UTF-8. Если байты не образуют корректный UTF-8, он сообщает, где начинается проблема, вместо того чтобы показывать искажённые символы.
Советы
- Для более короткого стандартного способа передавать байты в виде текста используйте «Кодирование и декодирование Base64».
- Переводите одно число между двоичной, десятичной и шестнадцатеричной системами? Воспользуйтесь «Переводом между системами счисления».
- Больше нравятся точки и тире? Попробуйте «Переводчик азбуки Морзе».
Вопросы и ответы
Как текст превращается в двоичный код?
Сначала каждый символ превращается в байты в кодировке UTF-8, которая используется в вебе, а затем каждый байт записывается восемью двоичными цифрами. Буква A — это байт 65, то есть 01000001. Простые английские буквы занимают по одному байту, буквы кириллицы и с диакритическими знаками — по два байта, а большинство эмодзи — четыре.
Это то же самое, что перевод из ASCII в двоичный код?
Для простых английских букв, цифр и знаков препинания да: UTF-8 даёт этим символам те же значения байтов, что и ASCII. Разница видна только для других символов, которые ASCII вообще не может представить.
Какой двоичный код можно расшифровать?
Группы из не более чем восьми нулей и единиц, разделённые пробелами, запятыми или переносами строк, по одной группе на байт, либо одну сплошную строку цифр, длина которой кратна восьми. Всё остальное, например цифра 2 или буква, сопровождается указанием позиции, чтобы вы могли это исправить.
Почему при расшифровке сообщается, что байты не являются корректным UTF-8?
Не всякая последовательность байтов является корректным текстом. Какого-то байта может не хватать или быть лишний, либо двоичный код получен из более старой кодировки или из файла, который не является текстом. В сообщении указан первый байт, который не удаётся прочитать. Проверьте, не потерялась ли какая-либо группа при копировании двоичного кода.
Что такое варианты hex, десятичный и восьмеричный?
Они записывают те же байты в другой системе счисления: hex использует две цифры 0–9 и a–f на байт (A — это 41), десятичная — числа от 0 до 255 (A — это 65), а восьмеричная — от 0 до 377 (A — это 101). Расшифровка принимает ту же систему, которую вы выбрали.
Загружается ли мой текст?
Нет. Преобразование выполняется в вашем браузере, а текст не загружается и не сохраняется.