Texte en binaire

Passe le texte en binaire sur 8 bits, selon l’encodage choisi. L’autre sens est binaire vers texte.

Huit bits par octet, l’encodage au choix

Le binaire, ici, ce sont les octets du texte, écrits par groupes de 8 bits. L’encodage décide de ces octets. UTF-8 est le défaut. La lettre A vaut 01000001 en UTF-8 comme en ASCII. 中文 fait six octets en UTF-8 et quatre en GBK, donc la suite de bits change avec le menu. L’autre sens, des bits vers le texte, est binaire en chaîne.

Dans quel ordre

  1. Collez le texte. Cette page ne lit pas de fichier.
  2. Choisissez l’encodage. Restez en UTF-8 tant que l’autre côté n’a pas nommé GBK, Big5, Shift_JIS ou UTF-16.
  3. « Espace entre les octets » est coché pour lire les groupes. Décochez-le s’il vous faut une suite de bits continue.
  4. Si l’encodage ne peut pas porter un caractère, la page le dit. Elle ne glisse pas un point d’interrogation. L’ASCII ne porte pas 中文.

Ce que sont ces bits

Chaque octet fait huit chiffres, bit de poids fort en tête. L’espace ne sépare les octets que si l’option est cochée. Ce n’est pas un bit de donnée. En mode Hex, la zone est déjà des octets hexadécimaux : espaces et 0x sont ignorés, un nombre impair de chiffres est une erreur. UTF-16 peut porter un BOM selon l’entrée choisie. Si l’autre bout n’en veut pas, prenez la forme BE ou LE sans BOM.

À quoi ça sert

  • Voir ce que devient un caractère une fois sorti d’Unicode.
  • Comparer UTF-8 et GBK sur la même phrase chinoise.
  • Contrôler une suite de bits avant un exercice de protocole.

Questions

J’ai déjà les bits, je veux le texte.

Passez par binaire en chaîne. Cette page ne va que du texte vers les bits.

L’ASCII a refusé une phrase banale.

L’ASCII, ce sont les lettres latines, les chiffres et quelques signes. Les accents et le chinois demandent UTF-8, ou un vieil encodage qui les contient vraiment.