Inspecteur de caractères Unicode
Divise le texte en caractères individuels et affiche le point de code, le nom, le bloc, la catégorie et la taille de chacun.
Inspecteur de caractères Unicode
Collez n'importe quel texte et cet outil le divise en caractères individuels, affichant pour chacun son point de code (U+XXXX), un nom lisible, son bloc Unicode, sa catégorie générale (lettre, marque, ponctuation, symbole, séparateur ou contrôle), une direction de texte approximative et le nombre d'octets qu'il occupe en UTF-8. Il est conçu pour ces moments où le texte semble correct mais se comporte de manière inattendue : un "guillemet intelligent" qui casse un analyseur JSON, un espace à largeur zéro égaré copié depuis une page web, un homoglyphe caché dans un nom de domaine, ou un emoji qui s'avère être plusieurs points de code collés ensemble.
Activez "fusionner les caractères identiques" pour fusionner les répétitions en une seule ligne par caractère distinct avec un décompte des occurrences : le moyen le plus rapide de répondre à "quels caractères apparaissent réellement dans ce fichier et combien de fois?". "Caractères non-ASCII uniquement" masque les A-Z ordinaires, les chiffres et la ponctuation de base pour qu'un long document n'affiche que les caractères qui valent la peine d'être examinés. "Décomposer les emoji composés" divise les séquences construites à partir de plusieurs points de code (drapeaux, emoji familiaux, variantes de tons de peau) en leurs éléments bruts au lieu d'énumérer toute la séquence comme une seule ligne. Choisissez un tableau simple pour lire à l'écran ou CSV pour coller dans une feuille de calcul.
Les noms de caractères proviennent d'une grande table intégrée couvrant ASCII, les lettres latines accentuées (construites selon la même règle lettre-de-base plus-diacritique qu'Unicode utilise), le cyrillique, le grec, les symboles courants, les idéogrammes CJK et les syllabes Hangul - pas la base de données complète d'environ 150 000 noms Unicode, trop lourde pour un onglet de navigateur. Les points de code rares ou non attribués reviennent à une description basée sur le bloc plutôt qu'une supposition, et la FAQ ci-dessous indique exactement où se situe la limite.
Tout fonctionne localement dans votre navigateur : le texte que vous inspectez, mots de passe et notes privées compris, n'est jamais envoyé nulle part. Copiez le résultat, téléchargez-le en tant que fichier .txt ou envoyez-le directement à un autre outil.