Pasa el texto a binario de 8 bits. Elige la codificación. El sentido inverso está en binario a texto.
Ocho bits por byte, en la codificación que elijas
Aquí binario son los bytes del texto, escritos en grupos de 8 bits. La codificación de caracteres decide esos bytes. UTF-8 es la predeterminada. La letra A es 01000001 en UTF-8 y en ASCII. 中文 son seis bytes en UTF-8 y cuatro en GBK, así que la cadena de bits cambia con el menú. El sentido contrario, de bits a texto, es binario a cadena.
Cómo usarla
Pega el texto. Esta página no lee un archivo.
Elige la codificación. Usa UTF-8 salvo que el otro lado haya nombrado GBK, Big5, Shift_JIS o UTF-16.
Deja «Espacio entre bytes» para leer los grupos. Apágalo si necesitas una sola cadena de bits seguida.
Si la codificación no puede guardar un carácter, la página lo dice en vez de meter signos de interrogación. ASCII no puede guardar 中文.
Qué son esos bits
Cada byte son ocho dígitos, el bit más significativo primero. El espacio separa bytes solo cuando esa opción está activa: no es un bit de datos. En modo hexadecimal la caja se toma como bytes hexadecimales ya escritos; se ignoran espacios y 0x, y un número impar de dígitos es un error. UTF-16 puede incluir una marca de orden de bytes según la codificación que elijas. Si quien recibe no quiere BOM, elige la forma BE o LE sin BOM.
Dónde se usa
Ver en qué se convierte un carácter al salir de Unicode.
Comparar UTF-8 y GBK para la misma frase en chino.
Revisar una cadena de bits antes de meterla en un ejercicio de protocolo.
ASCII son letras inglesas, dígitos y unos pocos signos, en siete bits. Las letras con tilde y el chino necesitan UTF-8, o una codificación antigua que de verdad los contenga.