Видаліть теги HTML
Видаліть усі теги HTML і XML і збережіть читабельний текст.
Видаліть теги HTML
Вставте фрагмент HTML і поверніть читабельний текст. Інструмент видаляє всі теги — div, spans, посилання, таблиці, цілі документи — і залишає те, що насправді побачить читач. Це найшвидший спосіб видалити статтю з джерела сторінки, очистити CMS або експорт інформаційного бюлетеня, отримати чесну кількість слів для копії, яка все ще загорнута в розмітку, або перетворити скопійований фрагмент на звичайний список.
Чотири варіанти охоплюють випадки, коли «здерти все» є занадто грубим. Декодування сутностей HTML перетворює & назад на амперсанд, на пробіл і — на тире, тому текст читається належним чином, а не показує його коди виведення. Зберігання розривів рядків дає <br> та тегам рівня блоку, таким як <p>, <li> і <h1>, новий рядок кожен, тому абзаци залишаються абзацами замість того, щоб згортатися в один наступний рядок; вимкніть його, і текст, що залишився, з’єднається точно так, як він стояв. У білому списку зберігаються теги, які ви називаєте — введіть «b, i, a», і це форматування зберігається, поки все інше зникає. Видалення вмісту сценарію та стилю повністю видаляє ці елементи, тому правила CSS і JavaScript ніколи не потрапляють у ваш текст. Він увімкнено за замовчуванням, тому що це майже завжди те, що ви хочете.
Видалення виконується рукописним сканером, а не шляхом розміщення вашого HTML на сторінці, тому нічого в розмітці не може працювати. Текст обробляється так само, як і браузер: "5 < 10" залишається, коментарі та типи документів зникають, а пошкоджений тег відкидається, а не друкується наполовину.
Усе відбувається у вашому браузері, і нічого не завантажується, тому внутрішні сторінки, роботу клієнта та неопубліковані чернетки безпечно вставляти. Скопіюйте результат, завантажте його як файл .txt або перемістіть назад у вхід для іншого проходу очищення.