Preskoči na vsebino
100% lokalno

Preglednik znakov Unicode

Razdelite besedilo na posamezne znake in si oglejte kodno točko, ime, blok, kategorijo in velikost vsakega znaka.

Vhod

Preglednik znakov Unicode

Prilepite poljuben tekst in to orodje ga bo razdelilo na posamezne znake, pri čemer za vsak prikaže njegovo kodno točko (U+XXXX), berljivo ime, blok Unicode, splošno kategorijo (črka, znak, ločilo, simbol, separator ali kontrolni znak), približno smer besedila in število bajtov v kodiranju UTF-8. Orodje je namenjeno trenutkom, ko besedilo izgleda dobro, vendar se obnaša nepričakovanoll — pametna narekovaja, ki prekineta razčlenjevalnik JSON, slučajno kopiran nič-širokostni prostor s spletne strani, homoglyph skrit v imenu domene ali emoji, ki se izkaže, da so pravzaprav štiri ali več kodnih točk lepljene skupaj.

Vključite "spoji enake znake", da stavite ponovitve v eno vrstico za vsak različni znak s štetjem pojavkov, kar je najhitrejši način odgovora na vprašanje "kateri znaki se resnično pojavljajo v tej datoteki in kako pogosto". "Samo znaki zunaj ASCII-ja" skrivajo navadne A-Z, številke in osnovno ločilo, tako da dolg dokument prikaže samo znake, vredne pozornosti. "Razstavi sestavljene emoji" razdeli sekvence, zgrajene iz več kodnih točk — zastave, družinske emoji, različice s tonom kože — v njihove surove gradnike namesto navedbe celotne sekvence kot ene vrstice; običajna pisma z diakritičnimi znaki ostanejo skupaj, ker bi bila to samo šum. Izberite navadno tabelo za branje na zaslonu ali CSV za lepljenje v preglednico.

Imena znakov izvirajo iz velike vgrajene tabele, ki pokriva ASCII, latinična pisma z diakritičnimi znaki (zgrajena po istem pravilu pisma-plus-diakritika, ki ga uporablja sam Unicode), cirilico, grščino, pogostih simbole, ideograme CJK in zlogove Hangul — ni kopija popolne baze podatkov z približno 150.000 vnosi z imeni Unicode, ki bi bila prevelika za pošiljanje na zavihek brskalnika. Redki ali nedodeljeni kodne točke se vrnejo na opis, ki temelji na bloku, namesto da bi ugibali, in pogosto postavljana vprašanja spodaj točno kažejo, kje je meja.

Vse se izvaja lokalno v vašem brskalniku: besedilo, ki ga pregledujete, vključno z gesli, zasebnimi opombami ali čimer koli drugim, česar ne bi prilepili v naključni obrazec, se nikoli ne pošlje nikamor. Kopirajte rezultat, ga preuzmite kot datoteko .txt ali ga pošljite neposredno drugemu orodju.

FAQ

Zakaj se emoji včasih prikaže kot več vrstic?
Emoji kot zastave, družinske grupe ali različice s tonom kože so pogosto zgrajene iz več kodnih točk Unicode, ki so združene skupaj. Privzeto orodje prikaže kot en znak; vključite "razstavi sestavljene emoji", da vidite posamezne kodne točke, iz katerih so sestavljene.
Kaj pomeni "blok" tukaj?
Blok Unicode je poimenovan razpon kodnih točk, kot sta "Basic Latin" ali "Cyrillic". Razvršča znake glede na njihovo lokacijo v standardu Unicode, kar se razlikuje od njihove splošne kategorije (črka, ločilo, simbol itd.).
So imena znakov vedno uradno ime Unicode?
Za ASCII, pogosta latinična pisma z diakritičnimi znaki, cirilico, grščino, ideograme CJK, zlogove Hangul in širok nabor pogostih simbolov in emoji, da. Za redkejše kodne točke orodje prikaže opisni fallback, ki temelji na bloku, namesto da bi ugibali natančno ime — popolna uradna baza podatkov imen vsebuje približno 150.000 vnosov in se ne zmešča na stran, poslano v vaš brskalnik.
Kako se določi smer besedila?
To je poenostavljeno preverjanje, ne popoln algoritem Unicode smer besedila: pisma iz desno-levo skriptov (arabščina, hebrejščina in podobno) so označena kot "rtl", druga pisma in številke so označena kot "ltr", in ločila, simboli in presledki so označeni kot "neutral".
Se moje besedilo pošlje nekam?
Ne. Vsak znak se preverja v celoti v vašem brskalniku — nič, kar prilepite tukaj, se ne pošlje na strežnik.