Sări la conținut
TextArray
Complet local

Entitățile HTML codifică și decodifică

Evadați caracterele speciale HTML sau transformați entitățile înapoi în text care poate fi citit.

Intrare

Entitățile HTML codifică și decodifică

Cinci caractere au semnificație structurală în HTML - și < > " și ", așa că orice text care le conține trebuie să fie eliminat înainte de a putea fi afișat ca conținut, mai degrabă decât interpretat ca markup. Lipiți text pentru a-l scăpa sau inserați markup scapat pentru a-l citi înapoi în formă simplă. Este cea mai rapidă modalitate de a pregăti un eșantion de cod pentru o postare de blog, de a plasa textul utilizatorului într-un șablon în siguranță sau de a decodifica fiecare flux exportat.

Selectorul domeniului controlează cât de mult se scapă. „Numai rezervat” atinge doar cele cinci caractere speciale și lasă orice altceva - litere accentuate, simboluri, emoji - ca UTF-8 literal, care este alegerea potrivită pentru orice pagină modernă servită ca UTF-8. „Rezervat + non-ASCII” convertește în plus fiecare caracter de deasupra intervalului ASCII într-o entitate numerică precum š, care este ceea ce doriți pentru sistemele vechi, șabloanele de e-mail sau mediile în care codificarea caracterelor este incertă.

Decodarea este mai amplă decât codificarea intenționată. Recunoaște cele aproximativ 120 de entități numite pe care le întâlniți efectiv în sălbăticie —   © — … é š săgeți, litere grecești, simboluri monetare și matematice — plus fiecare formă numerică, atât zecimal { cât și hexazecimal &#x1F600;, inclusiv caractere astrale precum emoji. Entitățile cu nume necunoscute sunt lăsate exact așa cum sunt, mai degrabă decât să fie aruncate în tăcere, astfel încât nimic nu se pierde.

Totul rulează în browserul dvs. fără un parser de markup și fără DOM implicat, așa că lipirea HTML neîncrezător aici nu poate executa nimic. Nimic nu este încărcat — textul rămâne pe dispozitiv. Numărul de sub rezultat numără câte entități au fost scrise sau rezolvate.

FAQ

La ce caractere scapă codificarea?
Cele cinci rezervate: & < > " și '. Cu "Rezervat + non-ASCII" fiecare caracter de deasupra punctului de cod 127 devine, de asemenea, o entitate numerică.
Trebuie să scap de literele accentuate și de emoji?
Nu pe o pagină modernă UTF-8 — „Numai rezervat” este suficient. Utilizați „Rezervat + non-ASCII” pentru sistemele vechi sau șabloanele de e-mail în care codificarea nu este de încredere.
Ce entități poate decoda?
Aproximativ 120 de entități cu nume comune plus toate formele numerice, zecimale și hexazecimale, inclusiv emoji. Entitățile numite pe care nu le recunoaște trec neschimbate.
Evadarea HTML face intrarea utilizatorului în siguranță?
Evadarea acestor caractere este apărarea de bază atunci când inserați text în conținut HTML, dar contextul contează - atributele, adresele URL și blocurile de script au nevoie de propria lor gestionare.
Textul meu este încărcat undeva?
Nu. Instrumentul rulează în întregime în browserul dvs., iar textul dvs. nu părăsește dispozitivul. Niciun marcaj nu este analizat sau executat.