Porta il testo in binario a 8 bit. Scegli la codifica. Il verso opposto è da binario a testo.
Otto bit per byte, nella codifica che scegli
Qui binario vuol dire i byte del testo, scritti a gruppi di 8 bit. La codifica dei caratteri decide quei byte. UTF-8 è il valore iniziale. La lettera A è 01000001 in UTF-8 e in ASCII. 中文 sono sei byte in UTF-8 e quattro in GBK, quindi la stringa di bit cambia col menu. Il verso opposto, dai bit al testo, è binario a testo.
Come si usa
Incolla il testo. Questa pagina non legge un file.
Scegli la codifica. Usa UTF-8, salvo che l’altra parte abbia nominato GBK, Big5, Shift_JIS o UTF-16.
Lascia «Spazio tra i byte» per leggere i gruppi. Spegnilo se ti serve una stringa di bit continua.
Se la codifica non può contenere un carattere, la pagina lo segnala invece di inserire punti interrogativi. L’ASCII non può contenere 中文.
Che cosa sono quei bit
Ogni byte è otto cifre, bit più significativo per primo. Lo spazio separa i byte solo con l’opzione accesa: non è un bit di dato. In modalità esadecimale la casella è trattata come byte esadecimali già scritti; spazi e 0x si ignorano, e un numero dispari di cifre è un errore. UTF-16 può includere un byte order mark secondo la codifica che scegli. Se chi riceve non vuole il BOM, scegli la forma BE o LE senza BOM.
Dove si usa
Vedere in che cosa diventa un carattere quando esce da Unicode.
Confrontare UTF-8 e GBK per la stessa frase cinese.
Controllare una stringa di bit prima di un esercizio di protocollo.
Domande
Ho già i bit e voglio il testo.
Usa binario a testo. Questa pagina va solo dal testo ai bit.
Perché l’ASCII è fallito su una frase normale?
L’ASCII sono lettere inglesi, cifre e pochi segni, su sette bit. Lettere accentate e cinese chiedono UTF-8, o una codifica vecchia che li contenga davvero.