Come contare parole e caratteri online (e perché i numeri differiscono)
Incolla lo stesso testo in Microsoft Word, Twitter, Google Docs e un contatore del browser e potresti vedere quattro diversi conteggi di caratteri. Non è un bug: è perché ogni app conta qualcosa di leggermente diverso e sono tutte tecnicamente corrette. Comprendere la differenza è importante quando scrivi il titolo di un articolo, un tweet o un testo SEO con un limite di caratteri.
Parole contro caratteri contro caratteri senza spazi
IL contatore di parole distingue tra tre misurazioni semplici. Parole sono sequenze di lettere, numeri e apostrofi separati da spazi o segni di punteggiatura. Caratteri conta ogni singolo carattere inclusi spazi, punteggiatura ed emoji. Caratteri senza spazi elimina gli spazi bianchi ma mantieni tutto il resto. Per un tweet con un limite di caratteri, questa distinzione è importante: il limite si applica a ciò che contano i browser, ovvero al conteggio completo dei caratteri compresi gli spazi.
Perché Word, Twitter e i browser non sono d'accordo
Il disaccordo avviene a causa del modo in cui i diversi sistemi rappresentano il testo. La maggior parte dei testi in inglese sono semplici: un carattere nell'editor equivale a un'unità da contare. Ma gli emoji, combinando segni diacritici e caratteri non latini, smentiscono questo presupposto. Un emoji come 👨👩👧 (famiglia) potrebbe essere visualizzato come un singolo glifo, ma è codificato come multiplo punti di codice (le unità Unicode interne). Microsoft Word potrebbe contarlo come un carattere, Twitter come tre e uno strumento compatibile con Unicode come cinque. Allo stesso modo, un carattere cinese o una lettera accentata come é potrebbe essere un carattere singolo o un carattere base più un segno di combinazione, a seconda di come è codificato.
La differenza sta in ciò che stai misurando: Punti di codice Unicode (l'unità tecnica), Unità di codice UTF-16 (come alcuni sistemi come JavaScript e Twitter li codificano), o cluster di grafemi (ciò che l'utente vede come un singolo carattere). Per la maggior parte degli scopi pratici, il contatore di parole su TextArray conta i grafemi, ovvero ciò che vedi effettivamente, che corrisponde alle aspettative dell'utente e funziona in modo coerente su tutte le emoji, combinando segni e script.
Quando è necessario contare i byte
Limiti diversi si applicano a luoghi diversi. I social media spesso contano i personaggi. I campi o le API del database potrebbero essere conteggiati byte — le unità di stoccaggio effettive dopo la codifica. Una singola emoji occupa 4 byte nella codifica UTF-8. Un carattere cinese occupa 3 byte. Se stai incollando del testo in un sistema con un limite di byte, il conteggio dei caratteri da solo non ti dirà se sarai adatto. IL Contatore byte UTF-8 mostra il costo esatto in byte del tuo testo, che è importante quando raggiungi i limiti API o i vincoli del database.
Tempo di lettura e conteggio delle frasi
Per scritti più lunghi (post di blog, articoli, documentazione) il conteggio delle parole è meno utile del tempo di lettura. Mille parole si leggono in modo diverso a seconda della lunghezza e della complessità della frase. IL tempo di lettura Lo strumento stima quanto tempo impiegherà un lettore medio per completarlo, dandoti un'idea se il pezzo è una rapida occhiata o un'immersione profonda. Accanto ad esso, il contatore di frasi mostra la lunghezza media della frase, che è un segnale grezzo ma utile per la leggibilità: le frasi più brevi sono generalmente più facili da leggere.
Tutti i conteggi sono locali e istantanei
Ogni conteggio su TextArray viene eseguito interamente nel tuo browser. Incolli il testo e i risultati si aggiornano immediatamente. Non è previsto alcun caricamento, nessun server e nessun account: il testo non lascia mai il tuo dispositivo. Ciò è importante quando lavori con bozze che non hai pubblicato, contenuti sensibili o qualsiasi cosa che preferiresti non incollare in un sito Web casuale. Puoi disconnetterti dalla rete e gli strumenti continueranno a funzionare.