Aller au contenu
TextArray
Tout en local

Extracteur de domaine

Extrayez des noms de domaine propres de tout texte rempli de liens et d'adresses e-mail.

Entrée
Sortie

Extracteur de domaine

Collez tout ce qui contient des liens ou des adresses e-mail – une newsletter, un fichier journal, une page HTML, une exportation CSV, une liste de contacts – et cet outil le réduit aux seuls domaines, un par ligne. À partir de https://www.example.com/shop/cart?id=1, il conserve example.com ; de [email protected], il conserve firma.sk. Tout le reste – les protocoles, les chemins, les chaînes de requête, les ports, la partie locale d'une adresse – est supprimé.

L'option source décide ce qui sera analysé : les URL uniquement, les adresses e-mail uniquement, ou les deux à la fois, dans l'ordre dans lequel elles apparaissent dans le texte. Les doublons sont supprimés par défaut, donc une page qui renvoie quarante fois vers le même site donne une ligne ; le décompte en direct montre toujours combien d'occurrences ont été trouvées et combien étaient uniques. Dépouiller www. normalise www.example.com et example.com dans la même entrée, et le tri par ordre alphabétique transforme le résultat en une liste ordonnée et comparable.

Le filtre TLD est le moyen le plus rapide de découper une liste mixte par marché : tapez .sk, .cz pour conserver uniquement les domaines slovaques et tchèques, ou .com pour isoler les domaines internationaux. Le filtre accepte les entrées avec ou sans le point initial et s'applique après le www-stripping, de sorte qu'il voit toujours le formulaire final. Les adresses IP brutes sont délibérément exclues : il s'agit d'une liste de domaines, pas d'un vidage d'hôte.

Utilisations typiques : création d'une liste de blocage ou d'une liste autorisée, vérification de l'emplacement d'un lien vers une page, extraction de domaines d'expéditeur à partir d'une exportation de courrier ou préparation d'une liste de domaines pour des vérifications WHOIS ou DNS groupées. Tout s'exécute localement dans votre navigateur : les journaux, les listes de diffusion et les données client ne quittent jamais votre appareil.

FAQ

Qu'est-ce qui compte exactement comme domaine ici ?
L'hôte d'une URL (https://…, http://…, ftp://… ou un simple www.…) et la partie après @ dans une adresse e-mail. L'hôte doit être un nom en pointillés – les adresses IP brutes telles que 192.168.0.1 sont volontairement exclues, car une liste de domaines est généralement l'entrée pour le travail DNS, WHOIS ou de liste de blocage.
Les domaines internationalisés avec accents sont-ils pris en charge ?
Oui. Les domaines écrits avec des lettres Unicode, tels que kaviareň.sk ou łódź.pl, sont extraits intacts et les formes punycode (xn--…) passent inchangées. La sortie conserve l’orthographe utilisée dans le texte, en minuscules.
Comment le filtre TLD traite-t-il les sous-domaines ?
Le filtre correspond à la fin du domaine, donc .com conserve blog.example.com ainsi que example.com. Il s'agit d'un filtre de suffixe, pas d'une recherche dans le registre : .co.uk fonctionne exactement de la même manière que .com.
Pourquoi user@ dans une URL ne produit-il pas de domaine de messagerie ?
Dans ftp://[email protected], la partie user@ est une URL userinfo, pas une adresse, donc l'outil extrait files.example.com une fois de l'URL et ne le compte pas deux fois comme un e-mail.
Mon texte est-il téléchargé quelque part ?
Non. L'extraction s'exécute entièrement dans votre navigateur et votre texte ne quitte jamais votre appareil.