Przejdź do treści
100% lokalnie

Kalkulator tokenów i kosztów LLM

Oszacuj, ile tokenów kosztuje wklejony tekst w popularnych interfejsach API LLM.

Wejście
Wynik

Kalkulator tokenów i kosztów LLM

Wklej monit, dokument lub transkrypcję czatu, a narzędzie oszacuje, ile tokenów zużyje, a następnie przeliczy tę kwotę na przybliżony koszt w dolarach dla kilku popularnych modeli — GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku i Claude Opus. Został stworzony z myślą o szybkiej kontroli poprawności przed wysłaniem dużej partii żądań za pośrednictwem interfejsu API, a nie jako substytut dokładnych numerów użycia, które raportuje później panel dostawcy.

Liczenie tokenów jest tutaj heurystyką, a nie dokładnym zliczaniem. Prawdziwe tokenizatory używają kodowania par bajtów trenowanego na ogromnych korpusach, a odtwarzanie jednej strony klienta oznaczałoby wysyłanie megabajtów tabel scalania dla jednej funkcji. Zamiast tego narzędzie to stosuje praktyczną zasadę cytatów z większości dokumentów API — mniej więcej cztery znaki lub trzy czwarte słowa na token w przypadku języka angielskiego i innych języków z alfabetem łacińskim — i przełącza na gęstszy współczynnik dla tekstu CJK (chiński, japoński, koreański), gdzie znak zwykle jest mapowany na prawie jeden token zamiast na ćwiartkę. Tekst mieszany jest klasyfikowany znak po znaku, więc akapit przełączający się między angielskim i japońskim otrzymuje szacunkową ocenę mieszaną.

Ceny referencyjne są ustalone na stałe i odpowiadają wartościom podanym przez każdego dostawcę podczas tworzenia tego narzędzia, w przeliczeniu na milion tokenów. Przełącz opcję „Cena jako żetony wyjściowe”, aby zamiast tego wyceniać tę samą liczbę przy współczynniku wyjściowym każdego modelu — dane wyjściowe są stale wyceniane wyżej niż dane wejściowe, co ma znaczenie przy szacowaniu ukończenia, a nie podpowiedzi. Tabela jest aktualizowana w miarę pisania, więc przycięcie monitu pokazuje jego wpływ na każdy model jednocześnie.

Wszystko działa lokalnie: wklejany tekst nigdy nie jest nigdzie przesyłany, więc można go bezpiecznie używać w podpowiedziach zawierających poufne materiały. Ponieważ liczba tokenów jest szacunkowa, traktuj je jako pomoc w planowaniu — aby uzyskać dokładne rozliczenia, sprawdź faktyczne wykorzystanie raportowane przez dostawcę interfejsu API.

Częste pytania

Jak dokładne jest oszacowanie tokena?
Jest to heurystyka, zwykle mieszcząca się w granicach około 10–20% rzeczywistej liczby w przypadku zwykłej prozy. Prawdziwe tokenizatory BPE można odtworzyć dokładnie jedynie poprzez przesłanie własnego słownictwa dostawcy, którego to narzędzie celowo unika, aby pozostało lekkim oszacowaniem po stronie klienta.
Dlaczego ten sam tekst jest szacowany inaczej w przypadku języków CJK?
Tekst chiński, japoński i koreański tokenizuje znacznie gęstiej niż tekst zapisany alfabetem łacińskim — często blisko jednego tokena na znak, a nie jednego tokena na cztery znaki. Narzędzie wykrywa te skrypty i stosuje oddzielny współczynnik, dzięki czemu szacunki pozostają rozsądne również w przypadku tekstu w różnych językach.
Czy ceny są aktualne?
Nie. Są to zakodowane na stałe ceny referencyjne, ustalone podczas tworzenia tego narzędzia, a nie pobrane z żadnego interfejsu API. Dostawcy okresowo zmieniają ceny, dlatego przed podjęciem decyzji budżetowej sprawdź aktualną stronę cenową dostawcy modelu.
Co zmienia „Cena jako żetony wyjściowe”?
Przełącza każdy model na współczynnik żetonów wyjściowych zamiast na współczynnik żetonów wejściowych. Tokeny wyjściowe są rozliczane według wyższej stawki niż tokeny wejściowe dla każdego modelu w tabeli, więc ten przełącznik jest przydatny, gdy szacujesz koszt wygenerowanej odpowiedzi, a nie wysyłanego monitu.
Czy mój tekst jest gdzieś przesłany?
Nie. Szacowanie tokenów i kalkulacja kosztów przebiegają całkowicie w Twojej przeglądarce — nic, co tu wkleisz, nie zostanie wysłane do OpenAI, Anthropic ani żadnej innej usługi.