Ga naar inhoud
100% lokaal

LLM-token en kostencalculator

Schat hoeveel tokens een geplakte tekst kost voor populaire LLM-API's.

Invoer
Uitvoer

LLM-token en kostencalculator

Plak een prompt, document of chattranscript en deze tool schat hoeveel tokens het zou verbruiken en zet dat vervolgens om in geschatte dollarkosten voor een handvol populaire modellen: GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku en Claude Opus. Het is gebouwd voor snelle controles voordat een grote hoeveelheid verzoeken via een API wordt verzonden, en niet als vervanging voor de exacte gebruikscijfers die het dashboard van een provider achteraf rapporteert.

Het tellen van tokens is hier een heuristiek, geen exacte telling. Echte tokenizers gebruiken byte-paarcodering die is getraind op enorme corpora, en het reproduceren van één clientzijde zou betekenen dat er megabytes aan samenvoegtabellen voor één functie moeten worden verzonden. In plaats daarvan past deze tool de vuistregel toe die in de meeste API-documenten wordt aangehaald (ongeveer vier tekens of driekwart van een woord per token voor Engelse en andere Latijnse schrifttalen) en schakelt over naar een dichtere verhouding voor CJK-tekst (Chinees, Japans, Koreaans), waarbij een teken gewoonlijk bijna één token in plaats van een kwart aangeeft. Gemengde tekst wordt karakter voor karakter geclassificeerd, dus een paragraaf die wisselt tussen Engels en Japans krijgt een gemengde schatting.

Referentieprijzen zijn hardgecodeerd op basis van wat elke provider vermeldde toen deze tool werd gebouwd, weergegeven per miljoen tokens. Schakel 'Prijs als uitvoertokens' in om in plaats daarvan hetzelfde aantal te prijzen met de uitvoersnelheid van elk model. De uitvoer wordt consequent hoger geprijsd dan de invoer, wat van belang is bij het schatten van een voltooiing in plaats van een prompt. De tabel wordt bijgewerkt terwijl u typt, zodat het bijsnijden van een prompt het effect ervan voor elk model tegelijk laat zien.

Alles draait lokaal: de tekst die je plakt wordt nergens geüpload, dus je kunt hem veilig gebruiken op een prompt die vertrouwelijk materiaal bevat. Omdat het aantal tokens een schatting is, dient u de cijfers te beschouwen als een planningshulpmiddel. Voor exacte facturering controleert u het gebruik dat uw API-provider daadwerkelijk rapporteert.

FAQ

Hoe nauwkeurig is de tokenschatting?
Het is een heuristiek, doorgaans binnen ongeveer 10-20% van de werkelijke telling voor gewoon proza. Echte BPE-tokenizers kunnen alleen exact worden gereproduceerd door het eigen vocabulaire van de provider te verzenden, wat deze tool opzettelijk vermijdt om een lichtgewicht schatting aan de clientzijde te blijven.
Waarom schat dezelfde tekst anders voor CJK-talen?
Chinese, Japanse en Koreaanse tekst is veel dichter in tokenvorm dan tekst in het Latijnse schrift: vaak bijna één token per teken in plaats van één token per vier tekens. De tool detecteert deze scripts en past een aparte verhouding toe, zodat de schatting ook voor tekst in gemengde talen redelijk blijft.
Zijn de prijzen live?
Nee. Het zijn hardgecodeerde referentieprijzen die zijn ingesteld toen deze tool werd gebouwd en die niet uit een API zijn opgehaald. Aanbieders wijzigen prijzen periodiek, dus controleer de huidige prijspagina van de modelaanbieder voordat u een budgetbeslissing neemt.
Wat verandert er bij 'Prijs als uitvoertokens'?
Het schakelt elk model over naar de output-token-snelheid in plaats van de input-token-snelheid. Uitvoertokens worden voor elk model in de tabel tegen een hoger tarief gefactureerd dan invoertokens. Deze schakelaar is dus handig wanneer u de kosten schat van een gegenereerd antwoord in plaats van een prompt die u verzendt.
Wordt mijn tekst ergens geüpload?
Nee. De tokenschatting en kostenberekening worden volledig in uw browser uitgevoerd. Niets dat u hier plakt, wordt naar OpenAI, Anthropic of een andere service verzonden.