가짜 텍스트 생성

테스트 목적으로 가짜/스푸핑 텍스트를 만들기 위해 시각적으로 유사한 유니코드 문자로 문자를 바꾸세요.

옵션 교체

가짜 텍스트 생성기 사용 방법: 단계별 가이드

  1. 원본 텍스트를 입력하세요
    • 위에 있는 '가짜 버전을 생성하기 위해 여기에 텍스트를 입력하세요...'라고 표시된 텍스트 상자에 원본 텍스트를 입력하거나 붙여넣으세요. 한 문장부터 여러 단락까지 아무거나 입력할 수 있습니다.
    • 또는 '예제 불러오기' 버튼을 사용하여 필드를 샘플 텍스트로 채우거나, '파일 선택' 버튼을 클릭하여 컴퓨터에서 .txt 파일을 직접 업로드하여 대량 처리할 수 있습니다.
  2. 교체 설정 설정
    • "교체 옵션" 탭에서 변경할 문자 집합을 선택하세요. 기본적으로 문자, 숫자 및 기호가 최대 난독화를 위해 테스트됩니다.
    • 고급 옵션으로 출력을 다듬으세요: 덜 공격적이고 더 읽기 쉬운 변환을 위해 “기본 가독성 유지”를 선택하거나, 문자가 시각적으로 유사한 형태를 유지하도록 하려면 “호모글리프만 사용”을 선택하세요.
    • "대체 강도(Replacement Intensity)" 슬라이더를 조정하여 변경될 수 있는 문자 비율을 설정하세요. 낮은 값(예: 30%)은 약간의 변조를 야기하며, 100%는 완전한 변화를 보장합니다.
  3. 가짜 텍스트 생성, 복제 및 활용
    • "가짜 텍스트 생성" 버튼을 클릭하세요. 변환된 텍스트가 하단의 읽기 전용 결과 상자에 즉시 표시됩니다.
    • "결과 복사" 버튼을 사용하여 텍스트를 클립보드에 직접 복사하고 양식, 문서 또는 테스트 환경에 붙여넣을 수 있습니다. "텍스트 다운로드"를 클릭하면 출력물을 .txt 파일로 장치에 다운로드하여 오프라인 사용이나 기록 보관에 사용할 수 있습니다. "모두 지우기" 버튼은 새 세션을 위해 도구를 초기화합니다.

기술 설명: 가짜 텍스트 생성의 원리

기본 개념: 유니코드와 동형 문자

이 도구는 고급 유니코드 문자 대체 개념을 기반으로 합니다. 유니코드 표준에는 수백 개의 스크립트와 기호 집합을 포함하여 약 144,000개의 문자가 있습니다. 그리고 이 거대한 라이브러리 안에는 “동형 글자(homoglyph)”가 있습니다 — 다른 스크립트에서 온 문자들이 일반 라틴 알파벳의 문자와 매우 비슷하게 보이는 것입니다. 예를 들어, 키릴 문자 “а” (U 0430)는 라틴 문자 “a” (U 0061)와 거의 똑같이 보이지만, 이들은 완전히 다른 디지털 객체입니다. 저희 생성기 알고리즘은 사용자의 입력 텍스트를 읽고, 선택에 따라 대상 문자를 찾은 뒤, 이를 다른 유니코드 블록의 시각적으로 동일한 문자로 체계적으로 대체합니다. 이 절차는 사람의 눈에는 정상적으로 보이는 글쓰기를 만들어내지만, 서로 다른 디지털 코드로 구성되어 있어 많은 기술적 및 보안 목적을 위해 원본 정보를 성공적으로 속일 수 있습니다.

  • 문자 매핑 데이터베이스: 이 도구는 잘 관리되고 선별된 데이터베이스를 기반으로 하며, 일반적인 라틴 문자(a-z, A-Z), 숫자(0-9) 및 기호(!, @, #)를 키릴 문자, 그리스 문자, 수학 연산자 등에서 가장 유사한 유니코드 문자로 매핑해 줍니다.
  • 스마트 처리: "가독성 유지(Preserve readability)"를 켜면 알고리즘은 단어의 모양과 공간을 가장 적게 변경하는 대체를 선호합니다. "강도(Intensity)" 매개변수는 대체 논리를 사용자가 지정한 비율의 허용 가능한 문자에 무작위로 적용하여 점진적인 수준의 난독화를 가능하게 합니다.
  • 상황 인지 응답: 발전기는 공백, 구분 및 구조가 포함된 사용 가능한 텍스트 형식으로 출력을 유지합니다. 무작위로 의미 없는 내용을 출력하지 않고, 쉽게 눈으로 검사하거나 패턴 매칭 필터를 통과할 수 있는 입력의 일관된 복사본을 생성합니다.

문자 변환 예시

원래 문자 일반적인 동형 문자 대체 유니코드 소스 및 노트
a (라틴 소문자 a) а (키릴 소문자 а) U+0430. 모양이 같습니다. 고급 위장(사용자명, URL)에 쓰입니다.
e (라틴 소문자 e) е (키릴 소문자 е) U+0435. 거의 구별되지 않는 동형 문자로, 영어처럼 보이는 가짜 텍스트를 만들 때 핵심입니다.
o (라틴 소문자 o) о (키릴 소문자 о) U+043E. 또 하나의 시각적으로 동일한 대체로, 디지털 분석 없이는 잘 보이지 않습니다.
1 (숫자 1) l (라틴 소문자 l) 또는 I (키릴 문자 Palochka) U+006C 또는 U+04C0. 글자나 특수 문자로 숫자를 위장해 시스템을 혼동시키는 예입니다.

가짜 텍스트의 실제 적용 사례 및 사용 예

  • 소프트웨어 및 양식 검증: 개발자와 QA 테스터는 애플리케이션이 국제 문자 세트를 지원하는지 테스트하고, 입력 정화를 검증하며, IDN(국제화 도메인 이름) 스푸핑과 같은 동형문자 관련 보안 취약점을 테스트하기 위해 가짜 텍스트를 사용합니다. 이는 시스템이 잠재적으로 오해를 일으킬 수 있는 텍스트를 올바르게 거부하거나 인코딩하도록 보장하는 데 도움이 됩니다.
  • 데이터 프라이버시 및 익명화: 사진, 목업 또는 이름, 이메일, ID 등 민감한 정보를 포함하는 데모 데이터를 공유할 때, 이 도구를 사용하여 시각적으로 현실적이지만 완전히 가짜인 자리 표시자 텍스트를 생성할 수 있습니다. 이는 자료나 프레젠테이션의 시각적 맥락을 유지하면서 개인 정보를 보호합니다.
  • 소셜 미디어 및 사용자 이름 사용 가능 여부 확인: 사용자들은 플랫폼의 등록 시스템이 라틴 문자로 된 'Instagram'과 키릴 문자를 사용한 가짜 버전을 구분할 수 있는지 테스트하려고 할 수 있습니다. 이는 플랫폼 보안을 이해하고 사칭 위협을 피하는 데 중요합니다.
  • 스팸 필터 테스트 및 디지털 콘텐츠 제작: 콘텐츠 마케터와 보안 연구원은 스팸 필터, 표절 탐지기 및 콘텐츠 검열 알고리즘을 평가하기 위해 다양한 자료를 제작할 수 있습니다. 이는 다음과 같은 질문에 답하는 데 도움이 됩니다: "이 시스템이 겉보기에는 정상적이지만 디지털적으로 다른 텍스트를 표시할까요?"
  • 사이버 보안 교육 목적: 이는 동일문자 공격, 피싱 전략(예: 오해를 불러일으키는 URL 생성) 및 디지털 보안 교육과 대학 강좌를 위한 유니코드 지식의 필요성에 대한 실질적인 예시입니다.