Odstranite oznake HTML
Odstranite vse oznake HTML in XML in ohranite berljivo besedilo.
Odstranite oznake HTML
Prilepite kos HTML in pridobite nazaj berljivo besedilo. Orodje odstrani vsako oznako – div, razpone, povezave, tabele, celotne dokumente – in pusti tisto, kar bi bralec dejansko videl. To je najhitrejši način, da odstranite članek iz vira strani, počistite CMS ali izvoz glasila, dobite pošteno število besed za kopijo, ki je še vedno zavita v označbo, ali spremenite postrgani fragment v navaden seznam.
Štiri možnosti pokrivajo primere, ko je "odlepiti vse" preveč neotesano. Dekodiranje entitet HTML spremeni & nazaj v ampersand, v presledek in — v pomišljaj, tako da se besedilo pravilno bere, namesto da bi prikazalo svoje ubežne kode. Ohranjanje prelomov vrstic daje oznakam na ravni <br> in blokov, kot so <p>, <li> in <h1>, vsako novo vrstico, tako da odstavki ostanejo odstavki, namesto da se strnejo v eno zaporedno vrstico; izklopite in preostalo besedilo bo spojeno točno tako, kot je stalo. Seznam dovoljenih ohranja oznake, ki jih poimenujete - vnesite "b, i, a" in to oblikovanje preživi, medtem ko vse ostalo odpade. Če odstranite vsebino skriptov in slogov, ti elementi ostanejo v celoti, zato pravila CSS in JavaScript nikoli ne pristanejo v vašem besedilu. Privzeto je vklopljen, ker je to skoraj vedno tisto, kar želite.
Odstranjevanje se izvede z ročno napisanim optičnim bralnikom, nikoli z vstavljanjem vašega HTML-ja na stran, tako da se ne more izvajati nič v označbi. Besedilo se obravnava tako, kot ga obravnava brskalnik: »5 < 10« ostane, komentarji in tipi dokumentov izginejo, pokvarjena oznaka pa se izpusti, namesto da bi bila natisnjena napol.
Vse se zgodi v vašem brskalniku in nič se ne naloži, zato je notranje strani, delo odjemalca in neobjavljene osnutke varno prilepiti. Kopirajte rezultat, ga prenesite kot datoteko .txt ali ga premaknite nazaj na vnos za drugo čiščenje.