Contador de bytes UTF-8
Meça o tamanho real do texto em bytes UTF-8, unidades UTF-16, pontos de código e grafemas.
Contador de bytes UTF-8
A contagem de caracteres e o tamanho de bytes não são a mesma coisa. Em UTF-8, as letras simples do inglês ocupam um byte cada, mas "é" ocupa dois, a maioria dos caracteres CJK ocupa três e um emoji como 👋 ocupa quatro - portanto, uma mensagem de 160 caracteres pode facilmente ter muito mais do que 160 bytes. Cole qualquer texto e este contador relata seu tamanho exato de bytes UTF-8, as unidades de código UTF-16 que o .length do JavaScript reportaria, o número de pontos de código Unicode, a contagem de grafemas (caracteres percebidos pelo usuário, portanto, uma família 👨👩👧 conta como um) e o número de linhas, mais o tamanho armazenado em B, KB ou MB para ambas as codificações.
Essa análise responde rapidamente a perguntas práticas: essa string caberá em uma coluna VARCHAR(255) medida em bytes, um segmento SMS, um limite de carga útil de 64 KB, um orçamento de cabeçalho HTTP, uma cota localStorage? Por que um banco de dados reclama de uma string de “160 caracteres” e por que um emoji conta como dois caracteres em um sistema e um em outro? O contador mostra todas as definições concorrentes de "comprimento" lado a lado para que você possa ver exatamente qual delas seu limite usa.
As terminações de linha também são importantes para o tamanho dos bytes: um arquivo salvo com terminações CRLF do Windows é um byte por linha maior que o mesmo arquivo com terminações Unix LF. A opção de finais de linha permite medir o texto conforme colado ou como seria uma vez convertido para LF ou CRLF.
Tudo é computado localmente em seu navegador usando a API TextEncoder padrão — o texto que você cola nunca é carregado, portanto, arquivos de configuração, tokens e mensagens privadas podem ser medidos com segurança.