ASCII と Unicode の符号点

各文字の符号点を出すか、十進・十六進の符号点を文字に戻します。

符号点です。十六進のバイトではありません

ASCII は 0 から 127 です。漢字は ASCII の 1 バイトではなく、Unicode の符号点です。UTF-8 ではその符号点が複数バイトになります。このページは文字ごとに数を一つ出します。十進でも十六進でもできます。UTF-8 のバイト列は出しません。バイトを見るときは 文字列からバイト か テキストを二進数に です。

操作

  1. 文章か、空白・カンマ・改行で区切った符号を貼ります。
  2. 向きは「文字から符号点」か「符号点から文字」、基数は十進か十六進です。「入力と同時に更新」はオンのままで構いません。
  3. 例は「AB」です。十進は 65 66、十六進は 41 42 です。
  4. 一つでも選んだ基数の数でないか、有効な文字コードでないときは、全体がエラーになります。悪い一つを飛ばしません。

どの数か

65 は文字 A、20013 は「中」です。どちらも UTF-8 のバイトではありません。「中」の UTF-8 バイトは E4 B8 AD です。別の道具が漢字に十六進を三つ出すなら、それはバイトです。このページとは合いません。ここでの十六進に 0x も U+ も付きません。符号点から文字へ戻すとき、空白、カンマ、改行は区切りであり、結果には入りません。

使う場面

  • 仕様やエラーに出た十進の符号点を見ます。
  • よく似た二字の、どちらなのかを確かめます。
  • 解析の練習用に、短い符号の列を作ります。

よくある質問

「中」が 228 や E4 ではない

それは UTF-8 のバイトです。このページが出すのは符号点で、文字につき一つです。

絵文字が一つの数になった

その数が符号点です。絵文字は 65535 より大きい一つの符号点のことも、符号点の列のこともあります。符号点ごとに一つの数です。文字数と語数は別で、ここが数えるのは符号点です。