Конвертер текста и двоичного кода
Преобразуйте текст в двоичный код и двоичный код обратно в текст. Каждый символ кодируется в UTF-8 и записывается как 8-битный байт, поэтому поддерживаются буквы с диакритическими знаками, другие письменности и эмодзи. Разделяйте байты пробелами, запятыми или переводами строк либо вставляйте биты без разделителей. Работает в браузере.
Ввод
Вывод
Документация
Что такое текст в двоичном виде?
Компьютеры хранят текст в виде чисел. Каждому символу кодировка присваивает число, а эти числа хранятся как байты по 8 бит, где каждый бит - это 0 или 1. В ASCII и UTF-8 буква H имеет значение 72, что в двоичной системе записывается как 01001000. Запись текста в виде единиц и нулей - распространённый способ объяснить принцип работы компьютеров, спрятать сообщение в головоломке или украсить публикацию.
Описание инструмента
Этот инструмент преобразует текст в двоичный вид и двоичный код обратно в текст. Введите текст, чтобы получить его байты в двоичном виде, или вставьте двоичный код, чтобы прочитать текст. Выберите, будут ли байты разделяться пробелами, запятыми, переносами строк или никак. Используйте кнопку смены направления, чтобы развернуть результат и проверить его.
Возможности
- Преобразование текста в двоичный вид и двоичного кода в текст в одном месте
- Кодировка UTF-8, благодаря которой поддерживаются буквы с диакритическими знаками, кириллица, китайские символы и emoji, а также английский язык
- Разделение байтов пробелом, запятой, переносом строки или отсутствие разделителей
- Чтение двоичного кода, разделённого пробелами, запятыми, точками с запятой или переносами строк, а также последовательности битов без разделителей
- Поддержка 7-битных групп ASCII, например
1001000, и префиксов0b - Объяснение причины ошибки, если двоичный код невозможно прочитать
Как это работает
Текст кодируется в UTF-8. Английские буквы, цифры и знаки пунктуации занимают по одному байту, буквы с диакритическими знаками и кириллица - по два, большинство китайских и японских символов - по три, а emoji - по четыре. Каждый байт записывается как 8 бит с ведущими нулями. При чтении двоичного кода каждая группа между разделителями считается одним байтом. Группа длиннее 8 бит, а также последовательность битов без разделителей разделяется на группы по 8 бит. Затем байты декодируются в UTF-8, и инструмент сообщает об ошибке, если они не образуют корректный текст.
Советы
- Символ, занимающий в UTF-8 более одного байта, необходимо сохранять целиком. Удаление одного из его байтов сделает двоичный код нечитаемым.
- Двоичный код из старой таблицы ASCII может быть записан по 7 бит на символ. Сохраняйте пробелы между группами, чтобы каждая группа считывалась как один символ.
- Чтобы представить в двоичном виде отдельное число, а не текст, воспользуйтесь конвертером систем счисления.