Så fungerar IDN-homografattacker och så känner du igen dem
Internationaliserade domännamn (IDN) tillåter bokstäver från många skriftsystem. Vid en homografattack registrerar någon en domän där latinska bokstäver har bytts mot identiskt utseende bokstäver från ett annat skriftsystem, så att en länk ser ut som en betrodd adress men leder till en annan domän.
Genomräknat exempel
- Indata
- еxаmple.com
- Hittade skriftsystem
- kyrilliska (Cyrl), latinska (Latn)
- Flaggade tecken
- 2
| Position | Tecken | Kodpunkt | Skriftsystem | Ersättning | Regel |
|---|---|---|---|---|---|
| 0 | е | U+0435 | kyrilliska | e | Förväxlingstabell |
| 2 | а | U+0430 | kyrilliska | a | Förväxlingstabell |
- Punycode (det som DNS slår upp)
- xn--xmple-4ve7a.com
- Strikt ASCII-reserv
- example.com
Så fungerar det
- DNS fungerar bara med ASCII, så en etikett med andra tecken omvandlas till Punycode, som börjar med xn--. Punycode-formen är det verkliga namnet: om en välbekant adress blir xn--… är det inte den domän den ser ut att vara.
- Webbläsare visar oftast Punycode-formen när en etikett blandar skriftsystem, men e-postprogram, chattappar och dokument visar ofta den vilseledande Unicode-formen, och en etikett skriven helt i ett enda liknande skriftsystem kan slinka igenom.
- Klistra in domänen i detektorn för att kontrollera den. Ett flaggat tecken, fler än ett skriftsystem i en etikett eller en rensad form som skiljer sig från originalet betyder att du bör skriva adressen själv eller använda ett bokmärke i stället för länken.
Konvertering är den bästa ansträngningen: mappade förväxlingsobjekt och NFKC-vikning är deterministiska, men viss legitim Unicode kommer inte att flaggas.
Din text
Klistra in eller skriv — resultaten uppdateras när du skriver (lätt avstudsad för lång inmatning).
11 tecken skannade
2 misstänkta
Strikt ASCII-reserv
Original (misstänkta tecken markerade)
Misstänkta tecken i den ursprungliga vyn är understrukna och märkta "susp". förutom att markera färg.
suspicious character еxsuspicious character аmple.com
Rensad utdata
Teckenanalys
| Index (0-baserat) | Original | Byte | Kodpunkt | Anledning |
|---|---|---|---|---|
| 0 | е | e | U+0435 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 1 | x | x | U+0078 | Not flagged as a confusable or compatibility character. |
| 2 | а | a | U+0430 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 3 | m | m | U+006D | Not flagged as a confusable or compatibility character. |
| 4 | p | p | U+0070 | Not flagged as a confusable or compatibility character. |
| 5 | l | l | U+006C | Not flagged as a confusable or compatibility character. |
| 6 | e | e | U+0065 | Not flagged as a confusable or compatibility character. |
| 7 | . | . | U+002E | Not flagged as a confusable or compatibility character. |
| 8 | c | c | U+0063 | Not flagged as a confusable or compatibility character. |
| 9 | o | o | U+006F | Not flagged as a confusable or compatibility character. |
| 10 | m | m | U+006D | Not flagged as a confusable or compatibility character. |