LLM-token en kostencalculator
Schat hoeveel tokens een geplakte tekst kost voor populaire LLM-API's.
LLM-token en kostencalculator
Plak een prompt, document of chattranscript en deze tool schat hoeveel tokens het zou verbruiken en zet dat vervolgens om in geschatte dollarkosten voor een handvol populaire modellen: GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku en Claude Opus. Het is gebouwd voor snelle controles voordat een grote hoeveelheid verzoeken via een API wordt verzonden, en niet als vervanging voor de exacte gebruikscijfers die het dashboard van een provider achteraf rapporteert.
Het tellen van tokens is hier een heuristiek, geen exacte telling. Echte tokenizers gebruiken byte-paarcodering die is getraind op enorme corpora, en het reproduceren van één clientzijde zou betekenen dat er megabytes aan samenvoegtabellen voor één functie moeten worden verzonden. In plaats daarvan past deze tool de vuistregel toe die in de meeste API-documenten wordt aangehaald (ongeveer vier tekens of driekwart van een woord per token voor Engelse en andere Latijnse schrifttalen) en schakelt over naar een dichtere verhouding voor CJK-tekst (Chinees, Japans, Koreaans), waarbij een teken gewoonlijk bijna één token in plaats van een kwart aangeeft. Gemengde tekst wordt karakter voor karakter geclassificeerd, dus een paragraaf die wisselt tussen Engels en Japans krijgt een gemengde schatting.
Referentieprijzen zijn hardgecodeerd op basis van wat elke provider vermeldde toen deze tool werd gebouwd, weergegeven per miljoen tokens. Schakel 'Prijs als uitvoertokens' in om in plaats daarvan hetzelfde aantal te prijzen met de uitvoersnelheid van elk model. De uitvoer wordt consequent hoger geprijsd dan de invoer, wat van belang is bij het schatten van een voltooiing in plaats van een prompt. De tabel wordt bijgewerkt terwijl u typt, zodat het bijsnijden van een prompt het effect ervan voor elk model tegelijk laat zien.
Alles draait lokaal: de tekst die je plakt wordt nergens geüpload, dus je kunt hem veilig gebruiken op een prompt die vertrouwelijk materiaal bevat. Omdat het aantal tokens een schatting is, dient u de cijfers te beschouwen als een planningshulpmiddel. Voor exacte facturering controleert u het gebruik dat uw API-provider daadwerkelijk rapporteert.