テキストを二進数にする

選んだ文字コードで文章を 8 ビットの二進にします。逆はバイナリから文字列です。

1 バイトが 8 ビットです。文字コードは選びます

ここの二進は文章のバイトで、8 ビットずつです。文字コードがバイトを決めます。初期値は UTF-8 です。文字 A は UTF-8 でも ASCII でも 01000001 です。「中文」は UTF-8 で 6 バイト、GBK では 4 バイトなので、ビット列はメニューとともに変わります。ビットから文章へ戻すときは バイナリから文字列 です。

操作

  1. 文章を貼ります。このページはファイルを読みません。
  2. 文字エンコーディングを選びます。相手が GBK、Big5、Shift_JIS、UTF-16 を名指ししていないときは UTF-8 です。例は UTF-8 の文字 A です。
  3. 「バイトの間に空白」は初期状態でオンです。読みやすくするためです。隙間の無いビット列が欲しいときはオフにします。
  4. その文字コードに入らない字はエラーです。疑問符にはこっそり換えません。ASCII は「中文」を持てません。

ビットの意味

各バイトは 8 ビットで、上位が先です。空白が出るのは「バイトの間に空白」がオンのときだけで、データビットではありません。メニューの Hex は、欄の中身をすでに書いた十六進バイトとみなします。空白と 0x は無視し、桁数が偶数でないとエラーです。UTF-16 はビッグエンディアンかリトルエンディアンを、相手と合わせてください。

使う場面

  • 文字が Unicode を離れたあと、何になるかを見ます。
  • 同じ漢字の文を、UTF-8 と GBK で見比べます。日本語の相手なら Shift_JIS です。
  • プロトコルの練習に入れる前に、ビット列を確かめます。

よくある質問

ビットがすでにある。文章が欲しい

バイナリから文字列 を使ってください。このページは文章からビットだけです。

普通の文が ASCII で失敗する

ASCII は英字、数字、わずかな記号だけです。アクセント付きの文字、漢字、かなは UTF-8 か、それらを含む古い文字コードが必要です。