Cum să numărați cuvintele și caracterele online (și de ce numerele diferă)
Lipiți același text în Microsoft Word, Twitter, Google Docs și un contor de browser și este posibil să vedeți patru numere diferite de caractere. Nu este o eroare - este pentru că fiecare aplicație contează ceva ușor diferit și toate sunt corecte din punct de vedere tehnic. Înțelegerea diferenței contează atunci când scrieți un titlu de articol, un tweet sau o copie SEO cu o limită de caractere.
Cuvinte vs caractere vs caractere fără spații
The contor de cuvinte distinge între trei măsurători simple. Cuvinte sunt secvențe de litere, numere și apostrofe separate prin spații albe sau semne de punctuație. Personaje numărați fiecare caracter, inclusiv spațiile, semnele de punctuație și emoji. Personaje fără spații aruncați spațiul alb, dar păstrați totul. Pentru un tweet cu o limită de caractere, această distincție contează: limita se aplică la ceea ce contează browserele, care este numărul complet de caractere, inclusiv spațiile.
De ce Word, Twitter și browserele nu sunt de acord
Dezacordul are loc din cauza modului în care sistemele diferite reprezintă textul. Majoritatea textului în limba engleză este simplu - un caracter din editor este egal cu o unitate de numărat. Dar emoji, combinând semnele diacritice și scripturile non-latine, încalcă această presupunere. Un emoji precum 👨👩👧 (familie) poate fi redat ca un singur glif, dar este codificat ca mai multe puncte de cod (unitățile interne Unicode). Microsoft Word l-ar putea număra ca un caracter, Twitter ca trei și un instrument compatibil Unicode ca cinci. În mod similar, un caracter chinezesc sau o literă accentuată precum é poate fi un singur caracter sau un caracter de bază plus un semn de combinare, în funcție de modul în care este codificat.
Diferența se rezumă la ceea ce măsori: Puncte de cod Unicode (unitatea tehnică), Unități de cod UTF-16 (cum le codifică unele sisteme precum JavaScript și Twitter) sau clustere de grafeme (ceea ce utilizatorul vede ca un singur personaj). Pentru cele mai multe scopuri practice, contor de cuvinte pe TextArray numără grafemele — ceea ce vedeți de fapt — care se potrivește cu așteptările utilizatorilor și funcționează în mod consecvent pe emoji, combinând mărci și scripturi.
Când trebuie să numărați octeții
Limite diferite se aplică în locuri diferite. Rețelele de socializare numără adesea personajele. Câmpurile bazei de date sau API-urile pot conta octeți — unitățile de stocare efective după codificare. Un singur emoji necesită 4 octeți în codificare UTF-8. Un caracter chinezesc durează 3 octeți. Dacă lipiți text într-un sistem cu o limită de octeți, numărul de caractere singur nu vă va spune dacă vă veți potrivi. The Contor UTF-8 octeți arată costul exact în octeți al textului dvs., care contează atunci când atingeți limitele API sau constrângerile bazei de date.
Timpul de citire și numărul de propoziții
Pentru o scriere mai lungă - postări pe blog, articole, documentație - numărul de cuvinte este mai puțin util decât timpul de citire. O mie de cuvinte se citesc diferit, în funcție de lungimea și complexitatea propoziției. The timpul de lectură instrumentul estimează cât timp va dura un cititor mediu pentru a termina, oferindu-vă o idee dacă piesa este o trecere rapidă sau o scufundare adâncă. Alături de ea, contor de propoziții arată lungimea medie a propoziției, care este un semnal brut, dar util pentru lizibilitate - propozițiile mai scurte sunt de obicei mai ușor de citit.
Toate contorizările sunt locale și instantanee
Fiecare numărare a TextArray rulează în întregime în browserul dvs. Lipiți textul și rezultatele se actualizează instantaneu. Nu există încărcare, server și cont - textul nu părăsește niciodată dispozitivul dvs. Acest lucru contează atunci când lucrați cu schițe pe care nu le-ați publicat, conținut sensibil sau orice altceva pe care preferați să nu lipiți într-un site web aleatoriu. Vă puteți deconecta de la rețea, iar instrumentele continuă să funcționeze.