Aller au contenu
TextArray
Tout en local

Les entités HTML encodent et décodent

Échappez aux caractères spéciaux HTML ou reconvertissez les entités en texte lisible.

Entrée

Les entités HTML encodent et décodent

Cinq caractères ont une signification structurelle en HTML — & < > " et ' — donc tout texte qui les contient doit être échappé avant de pouvoir être affiché comme contenu plutôt que interprété comme un balisage. Collez le texte pour l'échapper ou collez le balisage échappé pour le relire sous forme simple. C'est le moyen le plus rapide de préparer un exemple de code pour un article de blog, de déposer le texte de l'utilisateur dans un modèle en toute sécurité ou de décoder une exportation de flux où chaque apostrophe arrive sous la forme '.

Le sélecteur de portée contrôle la quantité échappée. "Réservé uniquement" ne touche que les cinq caractères spéciaux et laisse tout le reste - lettres accentuées, symboles, emoji - en UTF-8 littéral, ce qui est le bon choix pour toute page moderne servie en UTF-8. "Réservé + non-ASCII" convertit en outre chaque caractère au-dessus de la plage ASCII en une entité numérique telle que š, ce que vous souhaitez pour les systèmes existants, les modèles de courrier électronique ou les environnements dans lesquels l'encodage des caractères est incertain.

Le décodage est volontairement plus large que l’encodage. Il reconnaît les quelque 120 entités nommées que vous rencontrez réellement dans la nature —   © — … é š flèches, lettres grecques, symboles monétaires et mathématiques — ainsi que toutes les formes numériques, décimales { et hexadécimales &#x1F600;, y compris les caractères astraux comme les emoji. Les entités nommées inconnues sont laissées exactement telles qu'elles sont plutôt que d'être supprimées silencieusement, donc rien n'est perdu.

Tout s'exécute dans votre navigateur sans analyseur de balisage ni DOM impliqué, donc coller ici du HTML non fiable ne peut rien exécuter. Rien n'est téléchargé : le texte reste sur votre appareil. Le décompte sous la sortie compte le nombre d’entités écrites ou résolues.

FAQ

À quels caractères l'encodage échappe-t-il ?
Les cinq réservés : & < > " et '. Avec "Réservé + non-ASCII", chaque caractère au-dessus du point de code 127 devient également une entité numérique.
Dois-je échapper aux lettres accentuées et aux emoji ?
Pas sur une page UTF-8 moderne — « Réservé uniquement » suffit. Utilisez « Réservé + non-ASCII » pour les systèmes existants ou les modèles de courrier électronique dont l'encodage n'est pas fiable.
Quelles entités peut-il décoder ?
Environ 120 entités nommées communes ainsi que toutes les formes numériques, décimales et hexadécimales, y compris les emoji. Les entités nommées qu'il ne reconnaît pas passent inchangées.
L'échappement du HTML sécurise-t-il la saisie de l'utilisateur ?
L'échappement de ces caractères constitue la principale défense lors de l'insertion de texte dans du contenu HTML, mais le contexte est important : les attributs, les URL et les blocs de script nécessitent leur propre gestion.
Mon texte est-il téléchargé quelque part ?
Non. L'outil fonctionne entièrement dans votre navigateur et votre texte ne quitte jamais votre appareil. Aucun balisage n'est analysé ou exécuté.