Zeigt den Codepoint jedes Zeichens, oder macht aus Dezimal- und Hex-Codes wieder Text.
ASCII sind die Zahlen 0 bis 127. Ein chinesisches Zeichen ist kein einzelnes ASCII-Byte, sondern ein Unicode-Codepoint, und in UTF-8 sind das mehrere Bytes. Diese Seite druckt pro Zeichen eine Zahl, dezimal oder hexadezimal. Den UTF-8-Dump liefert sie nicht. Dafür nehmen Sie Zeichenkette zu Bytes oder Text nach Binär.
65 66 und hexadezimal 41 42.65 ist das Zeichen A, 20013 ist 中. Beides sind keine UTF-8-Bytes. Die UTF-8-Bytes von 中 sind E4 B8 AD. Zeigt ein anderes Werkzeug für ein Zeichen drei Hex-Paare, zeigt es Bytes, und die Zahlen passen erst, wenn Sie das Werkzeug wechseln. Hex hier hat weder 0x noch U+. Auf dem Weg von Codes zurück zum Text sind Leerzeichen, Kommas und Umbrüche Trenner, keine Zeichen im Ergebnis.
Das sind UTF-8-Bytes. Diese Seite druckt den Codepoint, eine Zahl pro Zeichen.
Die Zahl ist der Codepoint. Ein Emoji kann ein Punkt über 65535 sein oder eine Folge mehrerer Punkte. Jeder Punkt ist eine Zahl.