Hur man räknar ord och tecken online (och varför siffrorna skiljer sig)
Klistra in samma text i Microsoft Word, Twitter, Google Docs och en webbläsarräknare, så kan du se fyra olika teckenantal. Det är inte en bugg - det beror på att varje app räknas något lite annorlunda, och de är alla tekniskt korrekta. Att förstå skillnaden är viktigt när du skriver en artikeltitel, en tweet eller SEO-kopia med en teckenbegränsning.
Ord vs tecken vs tecken utan mellanslag
De ordräknare skiljer mellan tre enkla mätningar. Ord är sekvenser av bokstäver, siffror och apostrof åtskilda av blanksteg eller skiljetecken. Karaktärer räkna varje enskild karaktär inklusive mellanslag, skiljetecken och emoji. Karaktärer utan mellanslag släpp blanktecken men behåll allt annat. För en tweet med en teckenbegränsning är denna distinktion viktig: gränsen tillämpas på vad webbläsare räknar, vilket är hela antalet tecken inklusive blanksteg.
Varför Word, Twitter och webbläsare inte håller med
Oenigheten uppstår på grund av hur olika system representerar text. Den mesta engelska texten är enkel - ett tecken i editorn motsvarar en enhet att räkna. Men emoji, som kombinerar diakritiska tecken och icke-latinska skript bryter det antagandet. En emoji som 👨👩👧 (familj) kan renderas som en enda glyf, men den är kodad som flera kodpunkter (de interna Unicode-enheterna). Microsoft Word kan räkna det som ett tecken, Twitter som tre och ett Unicode-medvetet verktyg som fem. På samma sätt kan ett kinesiskt tecken eller en bokstav med accent som é vara ett enstaka tecken eller ett bastecken plus ett kombinationstecken, beroende på hur det är kodat.
Skillnaden beror på vad du mäter: Unicode-kodpunkter (den tekniska enheten), UTF-16 kodenheter (hur vissa system som JavaScript och Twitter kodar dem), eller grafemkluster (vad användaren ser som ett enda tecken). För de flesta praktiska ändamål ordräknare på TextArray räknar grafem - vad du faktiskt ser - som matchar användarnas förväntningar och fungerar konsekvent över emoji, kombinerar märken och skript.
När du behöver räkna byte
Olika gränser gäller för olika platser. Sociala medier räknar ofta karaktärer. Databasfält eller API:er kan räknas bytes — de faktiska lagringsenheterna efter kodning. En enda emoji tar 4 byte i UTF-8-kodning. Ett kinesiskt tecken tar 3 byte. Om du klistrar in text i ett system med en bytegräns, kommer inte bara teckenantalet att berätta om du passar. De UTF-8 byte-räknare visar den exakta bytekostnaden för din text, vilket spelar roll när du når API-gränser eller databasbegränsningar.
Lästid och meningsantal
För längre skrivande - blogginlägg, artiklar, dokumentation - är ordräkningen mindre användbar än lästiden. Tusen ord läses olika beroende på meningslängd och komplexitet. De lästid verktyget uppskattar hur lång tid det kommer att ta en genomsnittlig läsare att slutföra, vilket ger dig en känsla av om stycket är en snabb skumning eller en djupdykning. Vid sidan av den meningsräknare visar den genomsnittliga meningslängden, vilket är en grov men användbar signal för läsbarheten — kortare meningar är vanligtvis lättare att läsa.
Alla räkningar är lokala och omedelbara
Varje räkning på TextArray körs helt i din webbläsare. Du klistrar in din text och resultaten uppdateras direkt. Det finns ingen uppladdning, ingen server och inget konto – texten lämnar aldrig din enhet. Det spelar roll när du arbetar med utkast som du inte har publicerat, känsligt innehåll eller något du helst inte skulle klistra in på en slumpmässig webbplats. Du kan koppla från nätverket och verktygen fortsätter att fungera.