Remplacez les caractères par des caractères Unicode visuellement similaires pour créer du texte faux/imité à des fins de test.
L'outil est basé sur la notion avancée de substitution de caractères Unicode. La norme Unicode comprend environ 144 000 caractères, incluant des centaines d'écritures et de ensembles de symboles. Et à l'intérieur de cette immense bibliothèque, on trouve des « homoglyphes » — des caractères provenant d'autres écritures qui semblent étrangement similaires aux caractères de l'alphabet latin standard. Par exemple, le « а » cyrillique (U 0430) apparaît presque exactement comme le « a » latin (U 0061), pourtant ce sont des objets numériques complètement différents. Notre algorithme générateur lit votre texte d'entrée, trouve les lettres cibles selon vos choix, puis les remplace méthodiquement par des caractères visuellement identiques provenant d'autres blocs Unicode. Cette procédure donne lieu à une écriture qui semble normale à l'œil humain, mais qui est composée d'un code numérique différent, et peut donc réussir à tromper l'information originale pour de nombreux usages techniques et de sécurité.
| Caractère original | Substitut homoglyphe courant | Source Unicode et Notes |
|---|---|---|
| a (petit a latin) | a (petite lettre cyrillique a) | U 0430. Même apparence. Utilisé pour la contrefaçon à haut niveau (noms d'utilisateur, URL). |
| e (petite lettre latine e) | е (petite lettre cyrillique Ie) | U 0435. L'homoglyph parfait est un ingrédient essentiel dans la construction d'un texte faux crédible dans des chaînes ressemblant à l'anglais. |
| o (o minuscule latin) | о (o cyrillique minuscule) | U 043E. Une autre similitude visuelle identique Souvent non visible sans analyse numérique. |
| 1 (Chiffre Un) | l (lettre latine minuscule L) ou I (lettre cyrillique Palochka) | U 006C ou U 04C0. Montre comment falsifier des chiffres avec des lettres ou d'autres caractères spéciaux pour tromper le système. |