Ta bort HTML-taggar
Ta bort alla HTML- och XML-taggar och behåll den läsbara texten.
Ta bort HTML-taggar
Klistra in en bit HTML och få tillbaka den läsbara texten. Verktyget tar bort varje tagg - divs, spann, länkar, tabeller, hela dokument - och lämnar det som en läsare faktiskt skulle se. Det är det snabbaste sättet att lyfta en artikel från en sidas källa, rensa upp ett CMS eller nyhetsbrevsexport, få ett ärligt antal ord för en kopia som fortfarande är insvept i uppmärkning, eller förvandla ett skrapat fragment till en vanlig lista.
Fyra alternativ täcker de fall där "strimma allt" är för trubbigt. Avkodning av HTML-entiteter förvandlas & tillbaka till ett och-tecken, till ett mellanslag och — till ett em-streck, så att texten läses korrekt istället för att visa dess escape-koder. Att behålla radbrytningar ger <br>- och blocknivåtaggar som <p>, <li> och <h1> en ny rad vardera, så att stycken förblir stycken istället för att komprimeras till en pågående rad; stäng av den och den återstående texten sammanfogas exakt som den stod. Vitlistan behåller taggarna du namnger - skriv "b, i, a" och den formateringen överlever medan allt annat går. Om du tar bort skript- och stilinnehåll tappar dessa element hela, så CSS-regler och JavaScript hamnar aldrig i din text. Den är på som standard, eftersom det nästan alltid är vad du vill ha.
Stripning görs med en handskriven skanner, aldrig genom att lägga in din HTML på sidan, så inget i uppmärkningen kan köras. Text behandlas som en webbläsare behandlar den: "5 < 10" stannar, kommentarer och dokumenttyper försvinner, och en trasig tagg släpps istället för att skrivas ut till hälften.
Allt händer i din webbläsare och ingenting laddas upp, så interna sidor, klientarbete och opublicerade utkast är säkra att klistra in. Kopiera resultatet, ladda ner det som en .txt-fil eller flytta det tillbaka till ingången för ett nytt rensningspass.