텍스트를 이진수로

고른 문자 인코딩으로 글을 8비트 이진수로 바꿉니다. 반대 방향은 이진수를 문자열로 되돌리는 도구입니다.

바이트마다 8비트, 인코딩은 고릅니다

여기 이진수는 글의 바이트를 8비트 묶음으로 쓴 것입니다. 어떤 바이트가 되는지는 문자 인코딩이 정합니다. 기본은 UTF-8입니다. A는 UTF-8에서도 ASCII에서도 01000001입니다. 中文은 UTF-8에서 6바이트, GBK에서 4바이트라 메뉴에 따라 비트열이 바뀝니다. 비트에서 글로 돌아오는 쪽은 이진수를 문자열로입니다.

쓰는 순서

  1. 글을 붙여 넣습니다. 이 페이지는 파일을 읽지 않습니다.
  2. 문자 인코딩을 고릅니다. 상대가 GBK, Big5, Shift_JIS, UTF-16을 지정하지 않았으면 UTF-8을 씁니다.
  3. 「바이트 사이에 공백」은 기본으로 켜져 있어 묶음이 보입니다. 끊김 없는 비트열이 필요하면 끕니다.
  4. 인코딩이 담지 못하는 글자는 오류입니다. 물음표로 바꾸지 않습니다. ASCII는 中文을 담지 못합니다.

이 비트가 무엇인지

바이트마다 8자리이고 높은 비트가 앞입니다. 공백은 「바이트 사이에 공백」이 켜졌을 때만 나오고, 데이터 비트가 아닙니다. Hex를 고르면 칸을 이미 적힌 16진수 바이트로 봅니다. 공백과 0x는 무시하고, 자릿수가 홀수면 오류입니다. UTF-16에 BOM이 붙는지는 고른 항목에 달립니다. 상대가 BOM을 원하지 않으면 BOM 없는 BE나 LE를 고릅니다.

이럴 때

  • 글자가 유니코드를 떠난 뒤 무엇이 되는지 볼 때.
  • 같은 한글 문장을 UTF-8과 GBK로 나란히 볼 때.
  • 프로토콜 연습에 넣기 전에 비트열을 맞출 때.

자주 묻는 말

비트는 이미 있고 글이 필요합니다.

이진수를 문자열로를 쓰세요. 이 페이지는 글에서 비트로만 갑니다.

평범한 문장이 ASCII에서 실패했습니다.

ASCII는 영문자, 숫자, 기호 일부뿐입니다. 악센트와 한글·한자는 UTF-8이나, 그 글자를 실제로 담는 옛 인코딩이 필요합니다.