Contador de bytes UTF-8
Mida el tamaño real del texto en bytes UTF-8, unidades UTF-16, puntos de código y grafemas.
Contador de bytes UTF-8
El número de caracteres y el tamaño de bytes no son lo mismo. En UTF-8, las letras en inglés simple ocupan un byte cada una, pero "é" ocupa dos, la mayoría de los caracteres CJK ocupan tres y un emoji como 👋 ocupa cuatro, por lo que un mensaje de 160 caracteres puede tener fácilmente más de 160 bytes. Pegue cualquier texto y este contador informará su tamaño exacto de bytes UTF-8, las unidades de código UTF-16 que informaría la longitud de JavaScript, la cantidad de puntos de código Unicode, el recuento de grafemas (caracteres percibidos por el usuario, por lo que una familia 👨👩👧 cuenta como una) y la cantidad de líneas, más el tamaño almacenado en B, KB o MB para ambas codificaciones.
Ese desglose responde rápidamente a preguntas prácticas: ¿esta cadena se ajustará a una columna VARCHAR(255) medida en bytes, un segmento de SMS, un límite de carga útil de 64 KB, un presupuesto de encabezado HTTP, una cuota de almacenamiento local? ¿Por qué una base de datos se queja de una cadena de "160 caracteres" y por qué un emoji cuenta como dos caracteres en un sistema y uno en otro? El contador muestra todas las definiciones competitivas de "longitud" una al lado de la otra para que pueda ver exactamente cuál utiliza su límite.
Los finales de línea también influyen en el tamaño de los bytes: un archivo guardado con terminaciones CRLF de Windows es un byte por línea más grande que el mismo archivo con terminaciones LF de Unix. La opción de finales de línea le permite medir el texto tal como se pegó o como se convertiría una vez a LF o CRLF.
Todo se calcula localmente en su navegador utilizando la API TextEncoder estándar: el texto que pega nunca se carga, por lo que es seguro medir los archivos de configuración, tokens y mensajes privados.