Saltar al contenido
Totalmente local

Calculadora de costos y tokens LLM

Calcule cuántos tokens cuesta un texto pegado en las API de LLM más populares.

Entrada
Salida

Calculadora de costos y tokens LLM

Pegue un mensaje, un documento o una transcripción de chat y esta herramienta estima cuántos tokens consumiría y luego los convierte en un costo aproximado en dólares en un puñado de modelos populares: GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku y Claude Opus. Está diseñado para realizar comprobaciones rápidas de cordura antes de enviar un gran lote de solicitudes a través de una API, no como un sustituto de las cifras de uso exactas que el panel de control de un proveedor informa posteriormente.

El recuento de tokens aquí es un recuento heurístico, no exacto. Los tokenizadores reales utilizan codificación de pares de bytes entrenada en corpus enormes, y reproducir un lado del cliente significaría enviar megabytes de tablas de combinación para una característica. En cambio, esta herramienta aplica la regla general que citan la mayoría de los documentos API (aproximadamente cuatro caracteres o tres cuartos de palabra por token para inglés y otros idiomas de escritura latina) y cambia a una proporción más densa para el texto CJK (chino, japonés, coreano), donde un carácter comúnmente se asigna a cerca de un token en lugar de un cuarto. El texto mixto se clasifica carácter por carácter, por lo que un párrafo que cambia entre inglés y japonés obtiene una estimación combinada.

Los precios de referencia están codificados según lo que cada proveedor enumeró cuando se creó esta herramienta, y se muestran por millón de tokens. En su lugar, cambie "Precio como tokens de salida" para fijar el precio del mismo conteo a la tasa de producción de cada modelo: la producción tiene un precio consistentemente más alto que el insumo, lo cual es importante al estimar una finalización en lugar de un aviso. La tabla se actualiza a medida que escribe, por lo que recortar un mensaje muestra su efecto en todos los modelos a la vez.

Todo se ejecuta localmente: el texto pegado nunca se carga a ningún sitio, por lo que es seguro con material confidencial. Como el recuento es una estimación, úselo como ayuda de planificación; para facturación exacta, revise el uso real que informa su proveedor de API.

Preguntas frecuentes

¿Qué tan precisa es la estimación del token?
Es una heurística, normalmente entre un 10% y un 20% del recuento real de la prosa ordinaria. Los tokenizadores BPE reales solo se pueden reproducir exactamente enviando el propio vocabulario del proveedor, lo que esta herramienta evita intencionalmente para seguir siendo una estimación liviana del lado del cliente.
¿Por qué el mismo texto se estima de manera diferente para los idiomas CJK?
Los textos en chino, japonés y coreano tienen una tokenización mucho más densa que el texto en escritura latina, a menudo cerca de una ficha por carácter en lugar de una ficha por cuatro caracteres. La herramienta detecta estas escrituras y aplica una proporción separada para que la estimación siga siendo razonable también para textos en idiomas mixtos.
¿Están los precios en vivo?
No. Son precios de referencia codificados establecidos cuando se creó esta herramienta, no obtenidos de ninguna API. Los proveedores cambian los precios periódicamente, así que consulte la página de precios actual del proveedor del modelo antes de tomar una decisión presupuestaria.
¿Qué cambia el "Precio como tokens de salida"?
Cambia cada modelo a su tasa de token de salida en lugar de su tasa de token de entrada. Los tokens de salida se facturan a una tarifa más alta que los tokens de entrada para cada modelo de la tabla, por lo que esta opción es útil cuando se estima el costo de una respuesta generada en lugar de un mensaje que se envía.
¿Mi texto está subido a alguna parte?
No. La estimación del token y el cálculo del costo se ejecutan completamente en su navegador; nada de lo que pegue aquí se envía a OpenAI, Anthropic o cualquier otro servicio.