Текст в двоичный вид

Переводит текст в 8-битный двоичный вид. Кодировку выбираете вы. Обратный путь — двоичное в строку.

Восемь бит на байт, в выбранной кодировке

Двоичный вид здесь — это байты текста, записанные группами по 8 бит. Кодировка решает, какие это байты. По умолчанию UTF-8. Буква A — это 01000001 и в UTF-8, и в ASCII. 中文 — шесть байтов в UTF-8 и четыре в GBK, поэтому битовая строка меняется вместе с меню. Обратный путь, из битов в текст, — двоичный в строку.

Как пользоваться

  1. Вставьте текст. Файл эта страница не читает.
  2. Выберите кодировку. Берите UTF-8, если другая сторона не назвала GBK, Big5, Shift_JIS или UTF-16.
  3. Оставьте «Пробел между байтами», чтобы группы читались. Снимите, если нужна сплошная битовая строка.
  4. Если кодировка не вмещает символ, страница сообщает об этом, а не подставляет вопросительные знаки. ASCII не вмещает 中文.

Что это за биты

Каждый байт — восемь цифр, старший бит первый. Пробел разделяет байты только при включённой опции: это не бит данных. В шестнадцатеричном режиме поле читается как уже записанные байты; пробелы и 0x отбрасываются, нечётное число цифр — ошибка. UTF-16 может включать метку порядка байтов в зависимости от выбранной кодировки. Если принимающей стороне BOM не нужен, берите форму BE или LE без BOM.

Где это нужно

  • Увидеть, во что превращается символ, когда он уходит из Unicode.
  • Сравнить UTF-8 и GBK для одной китайской фразы.
  • Проверить битовую строку перед упражнением с протоколом.

Вопросы

Биты уже есть, нужен текст.

Откройте двоичный в строку. Эта страница идёт только от текста к битам.

Почему ASCII не взял обычную фразу?

ASCII — это английские буквы, цифры и немного знаков, семь бит. Буквы с диакритикой и иероглифы требуют UTF-8 или старой кодировки, которая их действительно содержит.