UTF-8 byte-räknare
Mät den verkliga storleken på text i UTF-8-byte, UTF-16-enheter, kodpunkter och grafem.
UTF-8 byte-räknare
Antal tecken och bytestorlek är inte samma sak. I UTF-8 tar vanliga engelska bokstäver en byte vardera, men "é" tar två, de flesta CJK-tecken tar tre och en emoji som 👋 tar fyra — så ett meddelande på 160 tecken kan lätt vara mycket mer än 160 byte. Klistra in vilken text som helst och den här räknaren rapporterar dess exakta UTF-8-bytestorlek, UTF-16-kodenheterna JavaScripts .length skulle rapportera, antalet Unicode-kodpunkter, grafemantal (användarupplevda tecken, så en 👨👩👧-familj räknas som en) och antalet lagrade raden i MB, KB och co.
Den uppdelningen svarar snabbt på praktiska frågor: kommer den här strängen att passa en VARCHAR(255)-kolumn mätt i byte, ett SMS-segment, en nyttolastgräns på 64 KB, en HTTP-headerbudget, en localStorage-kvot? Varför klagar en databas på en "160-teckens"-sträng, och varför räknas en emoji som två tecken i ett system och en i ett annat? Räknaren visar alla konkurrerande definitioner av "längd" sida vid sida så att du kan se exakt vilken din limit använder.
Radändelser har också betydelse för bytestorleken: en fil som sparas med Windows CRLF-ändelser är en byte per rad större än samma fil med Unix LF-ändelser. Alternativet för radändelser låter dig mäta texten som klistrad, eller som den en gång skulle konverteras till LF eller CRLF.
Allt beräknas lokalt i din webbläsare med det vanliga TextEncoder API - texten du klistrar in laddas aldrig upp, så konfigurationsfiler, tokens och privata meddelanden är säkra att mäta.