Preskoči na sadržaj
TextArray
100% lokalno

URL ekstraktor

Izvucite svaku vezu iz teksta ili HTML-a i dobijte čist popis URL-ova.

Unos
Rezultat

URL ekstraktor

Zalijepite stranicu teksta, neobrađeni HTML izvor ili izvoz i ovaj alat ispisuje svaku vezu koju sadrži. Čita vrijednosti href i src iz sidara, slika, skripti i stilova, a također preuzima gole URL-ove napisane u prozi, uključujući www hostove bez sheme. Korisno kada revidirate izlazne veze, sakupljate staze sredstava iz predloška ili pretvarate zid kopiranog teksta u popis s kojim zapravo možete raditi.

Duplikati se uklanjaju prema zadanim postavkama. Shema i host uspoređuju se bez obzira na velika i mala slova, pa se HTTPS://Example.com/a i https://example.com/a sažimaju u jedan unos, dok put i upit ostaju osjetljivi na velika i mala slova jer ih poslužitelji tako tretiraju. Poredajte abecednim redom za grupiranje dugačkog popisa prema hostu. Filtar protokola sužava rezultat na https ili http, ispuštajući ftp veze i www hostove bez sheme. Filtar domene odgovara podnizu hosta, a nikada putu, tako da example.com neće odgovarati poveznici na other.org koji ga samo spominje u segmentu puta. Domene samo zamjenjuju svaki URL s golim hostom, korisničkim imenom i priključkom koji su uklonjeni — brz način da vidite na koje stranice stranica vodi.

URL-ovi se vraćaju točno onako kako se pojavljuju u izvoru; ništa nije ponovno kodirano ili normalizirano, osim pretvaranja HTML-a izbjegnutog znaka & natrag u običan znak u nizovima upita. Rečenička interpunkcija zalijepljena na kraj obrezana je, a zatvorene zagrade su uravnotežene, tako da poveznica na Wikipediji koja završava na _ (crtica) ostaje netaknuta. Vrijednosti bez hosta — relativne staze, sidra, mailto, tel, javascript i podatkovni URI-ji — preskaču se. Zbroj pokazuje ukupan broj pojavljivanja, jedinstvene URL-ove i različite domene.

Sve radi u vašem pregledniku. HTML koji zalijepite, bilo s web-mjesta klijenta ili interne stranice, nikada se ne učitava.

FAQ

Pronalazi li veze unutar HTML atributa?
Da. href i src vrijednosti čitaju se iz sidara, slika, skripti i stilova, uz gole URL-ove u običnom tekstu. Vrijednost atributa čita se jednom i nikad se ponovno ne skenira kao goli tekst; ako se ista poveznica također pojavljuje kao vidljivi tekst, to je druga pojava, koja uklanja duplikate se sažima.
Mogu li navesti samo domene?
Uključi samo izdvajanje domena. Svaki URL zamjenjuje se svojim hostom, malim slovima, s uklonjenim korisničkim imenom i priključkom. Kombinirajte to s uklanjanjem duplikata za čisti popis web-mjesta.
Kako radi filtar domene?
Podudara se s podnizom hosta bez obzira na velika i mala slova, a ne na stazu. Upisivanjem example.com zadržava se shop.example.com i cdn.example.com, a preskače se poveznica na other.org koja samo spominje example.com na svom putu.
Zašto nedostaju mailto i relativne veze?
Alat navodi URL-ove koji imaju host. Sidra, relativne staze, mailto, tel, javascript i podatkovni URI-ji ne nose ništa, pa su izostavljeni umjesto dodani kao smetnja.
Je li moj tekst negdje uploadan?
Ne. Ekstrakcija se u potpunosti izvodi u vašem pregledniku, tako da HTML ili tekst koji zalijepite nikad ne napušta vaš uređaj.