Substitua caracteres por caracteres Unicode visualmente semelhantes para criar texto falso/imitação para fins de teste.
A ferramenta é baseada na noção avançada de substituição de caracteres Unicode. O padrão Unicode possui cerca de 144.000 caracteres, incluindo centenas de escrituras e conjuntos de símbolos. E dentro dessa gigantesca biblioteca existem “homógrafos” — caracteres de outras escrituras que parecem surpreendentemente semelhantes a caracteres do alfabeto latino comum. Por exemplo, o cirílico “а” (U 0430) parece quase exatamente como o latino “a” (U 0061), mas são objetos digitais completamente diferentes. Nosso algoritmo gerador lê seu texto de entrada, encontra as letras-alvo de acordo com suas escolhas e, então, substitui metodicamente por caracteres visualmente idênticos de outros blocos Unicode. Este procedimento resulta em uma escrita que parece normal ao olho humano, mas é composta de um código digital diferente e, portanto, é capaz de falsificar com sucesso a informação original para muitos fins técnicos e de segurança.
| Caractere original | Substituto Comum de Homógrafo | Fonte Unicode e Notas |
|---|---|---|
| a (a minúscula latina) | a (pequeno a cirílico) | U 0430. Mesma aparência. Usado para spoofing de alto nível (nomes de usuário, URLs). |
| e (e minúsculo latino) | е (I minúsculo cirílico) | U 0435. O homoglífico perfeito é um ingrediente essencial na construção de texto falso crível em sequências semelhantes ao inglês. |
| o (o minúsculo latino) | о (O minúsculo cirílico) | U 043E. Outra semelhança visual idêntica Muitas vezes não visível sem análise digital. |
| 1 (Dígito Um) | l (L minúsculo latino) ou I (Letra Palochka cirílica) | U 006C ou U 04C0. Mostra como falsificar números com letras ou outros caracteres especiais para confundir o sistema. |