Ir para o conteúdo
Totalmente local

Token LLM e calculadora de custos

Estime quantos tokens custa um texto colado em APIs LLM populares.

Entrada
Saída

Token LLM e calculadora de custos

Cole um prompt, documento ou transcrição de bate-papo e esta ferramenta estima quantos tokens consumiria e, em seguida, converte isso em um custo aproximado em dólares em vários modelos populares – GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku e Claude Opus. Ele foi desenvolvido para verificações rápidas de integridade antes de enviar um grande lote de solicitações por meio de uma API, e não como um substituto para os números exatos de uso que o painel de um provedor informa posteriormente.

A contagem de tokens aqui é uma contagem heurística, não uma contagem exata. Tokenizers reais usam codificação de pares de bytes treinada em grandes corpora, e reproduzir um lado do cliente significaria enviar megabytes de tabelas de mesclagem para um recurso. Em vez disso, esta ferramenta aplica a regra prática citada pela maioria dos documentos de API – aproximadamente quatro caracteres ou três quartos de uma palavra por token para inglês e outros idiomas de escrita latina – e muda para uma proporção mais densa para texto CJK (chinês, japonês, coreano), onde um caractere geralmente mapeia para perto de um token em vez de um quarto. O texto misto é classificado caractere por caractere, portanto, um parágrafo alternando entre inglês e japonês obtém uma estimativa combinada.

Os preços de referência são codificados de acordo com o que cada fornecedor listou quando esta ferramenta foi construída, mostrado por milhão de tokens. Em vez disso, alterne "Preço como tokens de saída" para precificar a mesma contagem na taxa de produção de cada modelo - a produção tem um preço consistentemente mais alto do que a entrada, o que é importante ao estimar uma conclusão em vez de um prompt. A tabela é atualizada conforme você digita, portanto, cortar um prompt mostra seu efeito em todos os modelos de uma só vez.

Tudo funciona localmente: o texto que você cola nunca é carregado em lugar nenhum, por isso é seguro usá-lo em um prompt contendo material confidencial. Como a contagem de tokens é uma estimativa, trate os números como uma ajuda de planejamento – para um faturamento exato, verifique o uso que seu provedor de API realmente relata.

FAQ

Quão precisa é a estimativa do token?
É uma heurística, normalmente dentro de cerca de 10-20% da contagem real da prosa comum. Tokenizers BPE reais só podem ser reproduzidos exatamente enviando o vocabulário do próprio provedor, o que esta ferramenta evita intencionalmente para permanecer uma estimativa leve do lado do cliente.
Por que o mesmo texto tem estimativas diferentes para idiomas CJK?
O texto em chinês, japonês e coreano é tokenizado com muito mais densidade do que o texto em escrita latina – geralmente perto de um token por caractere, em vez de um token por quatro caracteres. A ferramenta detecta esses scripts e aplica uma proporção separada para que a estimativa também permaneça razoável para textos em idiomas mistos.
Os preços estão ao vivo?
Não. Eles são preços de referência codificados, definidos quando esta ferramenta foi criada, e não obtidos de nenhuma API. Os provedores alteram os preços periodicamente, portanto, verifique a página de preços atual do fornecedor modelo antes de tomar uma decisão orçamentária.
O que muda o "Preço como tokens de saída"?
Ele muda cada modelo para sua taxa de token de saída em vez de sua taxa de token de entrada. Os tokens de saída são cobrados a uma taxa mais alta do que os tokens de entrada para cada modelo na tabela, portanto, essa alternância é útil quando você está estimando o custo de uma resposta gerada em vez de um prompt que está enviando.
Meu texto é carregado em algum lugar?
A estimativa do token e o cálculo do custo são executados inteiramente no seu navegador – nada do que você cola aqui é enviado para OpenAI, Anthropic ou qualquer outro serviço.