Remover tags HTML
Retire todas as tags HTML e XML e mantenha o texto legível.
Remover tags HTML
Cole um pedaço de HTML e recupere o texto legível. A ferramenta remove todas as tags – divs, spans, links, tabelas, documentos inteiros – e deixa o que o leitor realmente veria. É a maneira mais rápida de retirar um artigo do código-fonte de uma página, limpar um CMS ou uma exportação de boletim informativo, obter uma contagem honesta de palavras para uma cópia que ainda está embrulhada em marcação ou transformar um fragmento copiado em uma lista simples.
Quatro opções cobrem os casos em que “tirar tudo” é muito contundente. A decodificação de entidades HTML se transforma em um e comercial, em um espaço e — em um travessão, para que o texto seja lido corretamente em vez de mostrar seus códigos de escape. Manter as quebras de linha fornece às tags <br> e de nível de bloco, como <p>, <li> e <h1>, uma nova linha cada, para que os parágrafos permaneçam como parágrafos em vez de serem reduzidos a uma linha contínua; desligue-o e o texto restante será unido exatamente como estava. A lista de permissões mantém as tags que você nomeia – digite “b, i, a” e essa formatação sobrevive enquanto todo o resto continua. A remoção do conteúdo do script e do estilo elimina esses elementos por completo, de modo que as regras CSS e o JavaScript nunca chegam ao seu texto. Está ativado por padrão, porque quase sempre é isso que você deseja.
A remoção é feita por um scanner manuscrito, nunca colocando seu HTML na página, portanto, nada na marcação pode ser executado. O texto é tratado da mesma forma que um navegador o trata: "5 < 10" permanece, comentários e tipos de documentos desaparecem e uma tag quebrada é descartada em vez de impressa pela metade.
Tudo acontece no seu navegador e nada é carregado, portanto, páginas internas, trabalhos de clientes e rascunhos não publicados podem ser colados com segurança. Copie o resultado, baixe-o como um arquivo .txt ou mova-o de volta para a entrada para outra etapa de limpeza.