テキストを二進数にする
選んだ文字コードで文章を 8 ビットの二進にします。逆はバイナリから文字列です。
1 バイトが 8 ビットです。文字コードは選びます
ここの二進は文章のバイトで、8 ビットずつです。文字コードがバイトを決めます。初期値は UTF-8 です。文字 A は UTF-8 でも ASCII でも 01000001 です。「中文」は UTF-8 で 6 バイト、GBK では 4 バイトなので、ビット列はメニューとともに変わります。ビットから文章へ戻すときは バイナリから文字列 です。
操作
- 文章を貼ります。このページはファイルを読みません。
- 文字エンコーディングを選びます。相手が GBK、Big5、Shift_JIS、UTF-16 を名指ししていないときは UTF-8 です。例は UTF-8 の文字 A です。
- 「バイトの間に空白」は初期状態でオンです。読みやすくするためです。隙間の無いビット列が欲しいときはオフにします。
- その文字コードに入らない字はエラーです。疑問符にはこっそり換えません。ASCII は「中文」を持てません。
ビットの意味
各バイトは 8 ビットで、上位が先です。空白が出るのは「バイトの間に空白」がオンのときだけで、データビットではありません。メニューの Hex は、欄の中身をすでに書いた十六進バイトとみなします。空白と 0x は無視し、桁数が偶数でないとエラーです。UTF-16 はビッグエンディアンかリトルエンディアンを、相手と合わせてください。
使う場面
- 文字が Unicode を離れたあと、何になるかを見ます。
- 同じ漢字の文を、UTF-8 と GBK で見比べます。日本語の相手なら Shift_JIS です。
- プロトコルの練習に入れる前に、ビット列を確かめます。
よくある質問
ビットがすでにある。文章が欲しい
バイナリから文字列 を使ってください。このページは文章からビットだけです。
普通の文が ASCII で失敗する
ASCII は英字、数字、わずかな記号だけです。アクセント付きの文字、漢字、かなは UTF-8 か、それらを含む古い文字コードが必要です。