Preskoči na sadržaj
100% lokalno

Inspektor znakova Unicode

Razstavite tekst na pojedine znakove i pogledajte kodnu točku, naziv, blok, kategoriju i veličinu svakog znaka.

Unos

Inspektor znakova Unicode

Zalijepite bilo koji tekst i ovaj alat će ga rastaviti na pojedine znakove, prikazujući za svaki njegovu kodnu točku (U+XXXX), čitljiv naziv, Unicode blok, općenitu kategoriju (slovo, znak, interpunkcija, simbol, separator ili kontrolni znak), približan smjer teksta i broj bajtova u UTF-8 kodiranju. Alat je namenjen trenucima kada tekst izgleda dobro, ali se ponaša neočekivano — "pametna navodnika" koja prekida JSON parser, slučajno kopiran znak nulte širine sa web stranice, homoglyph skrit u domenskom imenu ili emoji koji se pokazao biti više kôdnih točaka zalijepljenih zajedno.

Uključite "spoji identične znakove" kako biste spojili ponavljanja u jedan redak po različitom znaku s brojem pojavljivanja, što je najbrži način da odgovorite "koji znakovi se zaista pojavljuju u ovoj datoteci i kako često". "Samo znakovi van ASCII-a" skriva obične A-Z, brojeve i osnovnu interpunkciju kako bi dugačak dokument pokazao samo znakove vrijedne pažnje. "Razloži složene emoji znakove" dijeli sekvence sagrađene od nekoliko kôdnih točaka — zastave, roditeljske emoji, varijante s tonama kože — u njihove sirovate gradivne blokove umjesto prikaza cijele sekvence kao jedan redak; obična pisma sa dijakritičkim znakovima ostaju zajedno ionako, jer bi to bilo samo buka. Odaberite običnu tablicu za čitanje na ekranu ili CSV za ljepljenje u proračunsku tablicu.

Imena znakova dolaze iz velike ugrađene tablice koja pokriva ASCII, latinična pisma s dijakritičkim znakovima (izgrađena prema istom pravilu pismeno-plus-diakritika koje koristi sam Unicode), ćiriličko, grčko, česta simbola, CJK ideograme i Hangul slogove — nije kopija potpune baze podataka s oko 150 000 stavki s nazivima Unicode, što bi bilo preveliko za slanje na karticu preglednika. Rijetke ili nedodijeljene kodne točke vraćaju se na opis temeljen na bloku umjesto pogađanja, a Često postavljana pitanja dolje navedena točno pokazuju gdje je granica.

Sve se izvršava lokalno u vašem pregledniku: tekst koji inspecirate, uključujući lozinke, privatne bilješke ili bilo što drugo što ne biste zalijepili u slučajni web obrazac, nikada se ne šalje nigdje. Kopirajte rezultat, preuzmite kao datoteku .txt ili ga pošaljite izravno drugom alatu.

FAQ

Zašto se emoji ponekad prikazuje kao nekoliko redaka?
Emoji kao zastave, obiteljske grupe ili varijante s tonama kože često su sagrađeni od više kôdnih točaka Unicode spojenih zajedno. Prema zadanoj postavci, alat ih prikazuje kao jedan znak; uključite "razloži složene emoji znakove" da vidite individualne kodne točke od kojih se sastoje.
Što znači "blok" ovdje?
Blok Unicode je naminan raspon kôdnih točaka, kao što su "Basic Latin" ili "Cyrillic". Grupira znakove prema mjestu gdje se nalaze u standarde Unicode, što je drugačije od njihove općenite kategorije (slovo, interpunkcija, simbol itd.).
Jesu li imena znakova uvijek službeni Unicode naziv?
Za ASCII, česta latinična pisma s dijakritičkim znakovima, ćiriličko, grčko, ideograme CJK, slogove Hangul i širok skup čestih simbola i emoji, da. Za rijednije kodne točke alat prikazuje opisni fallback temeljen na bloku umjesto pogađanja točnog imena — potpuna službena baza podataka imena ima oko 150 000 stavki i ne staje na stranicu poslanu u vaš preglednik.
Kako se određuje smjer teksta?
To je pojednostavljena provjera, ne potpuni Unicode bidirekcijski algoritam: pisma iz desna-u-lijevo skriptova (arapski, hebrejski i slično) označena su kao "rtl", druga pisma i brojke označeni su kao "ltr", a interpunkcija, simboli i razmaci označeni su kao "neutral".
Šalje li se moj tekst negdje?
Ne. Svaki znak se provjeri potpuno u vašem pregledniku — ništa što zalijepite ovdje se ne prati na server.