URL extraherare
Dra ut varje länk från text eller HTML och få en ren lista med webbadresser.
URL extraherare
Klistra in en sida med text, en rå HTML-källa eller en export och detta verktyg listar alla länkar som det innehåller. Den läser href- och src-värden från ankare, bilder, skript och stilmallar, och den plockar också upp nakna webbadresser skrivna på löpande prosa, inklusive www-värdar utan schema. Användbart när du granskar utgående länkar, samlar tillgångsvägar från en mall eller förvandlar en vägg med kopierad text till en lista som du faktiskt kan arbeta med.
Dubbletter tas bort som standard. Schema och värd jämförs utan hänsyn till skiftläge, så HTTPS://Example.com/a och https://example.com/a kollapsar till en post, medan sökvägen och frågan förblir skiftlägeskänsliga eftersom servrar behandlar dem på det sättet. Sortera i alfabetisk ordning för att gruppera en lång lista efter värd. Protokollfiltret begränsar resultatet till https eller http, släpper ftp-länkar och schemalösa www-värdar. Domänfiltret matchar en delsträng av värden och aldrig sökvägen, så example.com matchar inte en länk till other.org som bara nämner det i ett sökvägssegment. Domäner ersätter endast varje webbadress med dess blotta värd, användarnamn och port – ett snabbt sätt att se vilka webbplatser en sida länkar ut till.
URL:er kommer tillbaka exakt som de visas i källan; ingenting kodas om eller normaliseras, förutom att förvandla ett HTML-escapet et-tecken tillbaka till ett vanligt i frågesträngar. Meningsinterpunktion limmade på slutet trimmas och avslutande parenteser är balanserade, så en Wikipedia-länk som slutar på _(stapel) överlever intakt. Värden utan värd – relativa sökvägar, ankare, mailto, tel, javascript och data-URI:er – hoppas över. Sammanställningen visar totala förekomster, unika webbadresser och distinkta domäner.
Allt körs i din webbläsare. HTML-koden du klistrar in, oavsett om den är från en kundwebbplats eller en intern sida, laddas aldrig upp.