Hoppa till innehåll
100% lokalt

LLM token och kostnadskalkylator

Uppskatta hur många tokens en inklistrad text kostar över populära LLM API:er.

Inmatning
Utmatning

LLM token och kostnadskalkylator

Klistra in en prompt, dokument eller chattranskription och det här verktyget uppskattar hur många tokens det skulle förbruka, och omvandlar det sedan till en ungefärlig dollarkostnad över en handfull populära modeller – GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku och Claude Opus. Den är byggd för snabba förnuftskontroller innan du skickar ett stort antal förfrågningar via ett API, inte som ett substitut för de exakta användningssiffrorna som en leverantörs instrumentpanel rapporterar efteråt.

Tokenräkning här är en heuristik, inte en exakt räkning. Riktiga tokenizers använder byte-par-kodning tränad på enorma korpora, och att återskapa en klientsida skulle innebära att man skickar megabyte av sammanslagningstabeller för en funktion. Istället tillämpar det här verktyget tumregeln för de flesta API-dokument – ungefär fyra tecken eller tre fjärdedelar av ett ord per token för engelska och andra latinska språk – och växlar till ett tätare förhållande för CJK-text (kinesiska, japanska, koreanska), där ett tecken vanligtvis mappas till nära en token istället för en fjärdedel. Blandad text klassificeras tecken för tecken, så ett stycke som växlar mellan engelska och japanska får en blandad uppskattning.

Referenspriser är hårdkodade till vad varje leverantör angav när detta verktyg byggdes, visat per miljon tokens. Växla "Pris som output tokens" för att prissätta samma antal vid varje modells produktionshastighet istället - output prissätts konsekvent högre än input, vilket är viktigt när man uppskattar ett slutförande snarare än en prompt. Tabellen uppdateras när du skriver, så att trimma en prompt visar dess effekt på alla modeller samtidigt.

Allt körs lokalt: texten du klistrar in laddas aldrig upp någonstans, så den är säker att använda på en prompt som innehåller konfidentiellt material. Eftersom tokenantalet är en uppskattning, behandla siffrorna som ett planeringshjälp - för exakt fakturering, kontrollera användningen som din API-leverantör faktiskt rapporterar.

FAQ

Hur exakt är tokenuppskattningen?
Det är en heuristik, vanligtvis inom cirka 10-20% av det verkliga antalet för vanlig prosa. Real BPE tokenizers can only be reproduced exactly by shipping the provider's own vocabulary, which this tool intentionally avoids to stay a lightweight, client-side estimate.
Varför uppskattar samma text olika för CJK-språk?
Chinese, Japanese and Korean text tokenizes far more densely than Latin-script text — often close to one token per character rather than one token per four characters. Verktyget upptäcker dessa skript och tillämpar ett separat förhållande så att uppskattningen förblir rimlig även för blandad text.
Är priserna live?
Nej. De är hårdkodade referenspriser som sattes när detta verktyg byggdes, inte hämtade från något API. Leverantörer ändrar prissättning med jämna mellanrum, så kontrollera modellleverantörens aktuella prissättningssida innan du fattar ett budgetbeslut.
Vad ändras "Pris som output tokens"?
Den växlar varje modell till sin output-token-hastighet istället för sin input-token-hastighet. Utdatatokens faktureras till en högre hastighet än indatatokens för varje modell i tabellen, så den här växlingen är användbar när du uppskattar kostnaden för ett genererat svar snarare än en prompt du skickar.
Är min text uppladdad någonstans?
Nej. Tokenuppskattningen och kostnadsberäkningen körs helt och hållet i din webbläsare – inget du klistrar in här skickas till OpenAI, Anthropic eller någon annan tjänst.