Domeinextractor
Haal schone domeinnamen uit elke tekst vol links en e-mailadressen.
Domeinextractor
Plak alles dat links of e-mailadressen bevat – een nieuwsbrief, een logbestand, een HTML-pagina, een CSV-export, een lijst met contacten – en deze tool reduceert het tot alleen de domeinen, één per regel. Van https://www.example.com/shop/cart?id=1 blijft voorbeeld.com behouden; van [email protected] blijft firma.sk behouden. Al het andere – protocollen, paden, querystrings, poorten, het lokale deel van een adres – wordt weggenomen.
De bronoptie bepaalt wat er wordt gescand: alleen URL's, alleen e-mailadressen of beide tegelijk, in de volgorde waarin ze in de tekst verschijnen. Duplicaten worden standaard verwijderd, zodat een pagina die veertig keer naar dezelfde site linkt één regel oplevert; de live telling laat nog steeds zien hoeveel exemplaren er zijn gevonden en hoeveel er uniek waren. Strip www. normaliseert www.example.com en example.com in hetzelfde item, en alfabetisch sorteren verandert het resultaat in een nette, vergelijkbare lijst.
Het TLD-filter is de snelste manier om een gemengde lijst op markt te verdelen: typ .sk, .cz om alleen Slowaakse en Tsjechische domeinen te behouden, of .com om de internationale domeinen te isoleren. Het filter accepteert vermeldingen met of zonder de leidende punt en wordt toegepast na www-stripping, zodat het altijd het definitieve formulier ziet. Onbewerkte IP-adressen zijn opzettelijk uitgesloten: dit is een domeinlijst, geen hostdump.
Typische toepassingen: het opstellen van een blokkeer- of toelatingslijst, controleren waar een pagina naartoe linkt, afzenderdomeinen extraheren uit een e-mailexport, of een domeinlijst voorbereiden voor bulk-WHOIS- of DNS-controles. Alles draait lokaal in uw browser: logs, mailinglijsten en klantgegevens verlaten uw apparaat nooit.