Códigos ASCII y Unicode

Muestra el punto de código de cada carácter, o convierte códigos decimales o hexadecimales en texto.

Puntos de código, no bytes en hexadecimal

ASCII son los números del 0 al 127. Un carácter chino no es un byte ASCII: es un punto de código Unicode, y en UTF-8 ese punto ocupa varios bytes. Esta página imprime un número por carácter, en decimal o en hexadecimal. No saca el volcado hexadecimal de los bytes UTF-8. Para esos bytes usa cadena a bytes o texto a binario.

Cómo usarla

  1. Pega texto, o una lista de códigos separados por espacios, comas o saltos de línea.
  2. Elige «Texto a códigos» o «Códigos a texto», y luego Decimal o Hexadecimal.
  3. El ejemplo AB es 65 66 en decimal. En hexadecimal son 41 42.
  4. Un token que no es un número en la base elegida, o un número que no es un carácter, es un error. La página no se salta el token malo.

Qué número estás mirando

65 es el carácter A. 20013 es el carácter 中. Ninguno de los dos es un byte UTF-8: los bytes UTF-8 de 中 son E4 B8 AD. Si otra herramienta muestra tres pares hexadecimales para un carácter, está mostrando bytes, y esta página no va a coincidir hasta que cambies de herramienta. El hexadecimal de aquí no lleva 0x ni U+. Al volver de códigos a texto, espacios, comas y saltos son separadores, no caracteres que haya que codificar.

Dónde se usa

  • Leer un punto de código decimal que sale en una especificación o en un mensaje de error.
  • Comprobar que un carácter es el que crees, cuando dos se parecen.
  • Armar una lista corta de códigos para un ejercicio de analizador.

Preguntas

¿Por qué 中 no es 228 ni E4?

Esos son valores de byte en UTF-8. Esta página imprime el punto de código: un número por carácter.

Un emoji salió como un solo número, no como dos.

El número es el punto de código. Un emoji puede ser un solo punto por encima de 65535, o varios puntos si es una secuencia. Cada punto es un número.