Contatore byte UTF-8
Misura la dimensione reale del testo in byte UTF-8, unità UTF-16, punti di codice e grafemi.
Contatore byte UTF-8
Il conteggio dei caratteri e la dimensione dei byte non sono la stessa cosa. In UTF-8, le semplici lettere inglesi occupano un byte ciascuna, ma "é" ne richiede due, la maggior parte dei caratteri CJK ne richiede tre e un'emoji come 👋 ne richiede quattro, quindi un messaggio di 160 caratteri può facilmente essere molto più lungo di 160 byte. Incolla qualsiasi testo e questo contatore segnala la sua esatta dimensione in byte UTF-8, le unità di codice UTF-16 riportate da JavaScript .length, il numero di punti di codice Unicode, il conteggio dei grafemi (caratteri percepiti dall'utente, quindi una famiglia 👨👩👧 conta come una) e il numero di righe, più la dimensione memorizzata in B, KB o MB per entrambe le codifiche.
Questa suddivisione risponde rapidamente a domande pratiche: questa stringa si adatterà a una colonna VARCHAR(255) misurata in byte, un segmento SMS, un limite di payload di 64 KB, un budget di intestazione HTTP, una quota localStorage? Perché un database si lamenta di una stringa di "160 caratteri" e perché un'emoji conta come due caratteri in un sistema e uno in un altro? Il contatore mostra tutte le definizioni concorrenti di "lunghezza" una accanto all'altra in modo da poter vedere esattamente quale utilizza il tuo limite.
Anche le terminazioni di riga contano per la dimensione dei byte: un file salvato con terminazioni CRLF di Windows è un byte per riga più grande dello stesso file con terminazioni LF Unix. L'opzione delle terminazioni di riga ti consente di misurare il testo come incollato o come verrebbe una volta convertito in LF o CRLF.
Tutto viene calcolato localmente nel tuo browser utilizzando l'API TextEncoder standard: il testo che incolli non viene mai caricato, quindi i file di configurazione, i token e i messaggi privati sono sicuri da misurare.