Přeskočit na obsah
100% lokálně

LLM token a kalkulačka nákladů

Odhadněte, kolik tokenů stojí vložený text napříč oblíbenými LLM API.

Vstup
Výstup

LLM token a kalkulačka nákladů

Vložte výzvu, dokument nebo přepis chatu a tento nástroj odhadne, kolik tokenů by spotřeboval, a poté to převede na přibližnou cenu v dolarech u několika oblíbených modelů – GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku a Claude Opus. Je vytvořen pro rychlé kontroly zdravého rozumu před odesláním velké dávky požadavků prostřednictvím rozhraní API, nikoli jako náhrada za přesná čísla využití, která poté řídicí panel poskytovatele hlásí.

Počítání tokenů je zde heuristika, nikoli přesný počet. Skuteční tokenizéři používají kódování párů bajtů natrénované na obrovských korpusech a reprodukce jedné strany klienta by znamenalo dodání megabajtů slučovacích tabulek pro jednu funkci. Namísto toho tento nástroj uplatňuje základní pravidlo většiny citací dokumentů API – zhruba čtyři znaky nebo tři čtvrtiny slova na token pro angličtinu a další jazyky s latinkou – a přepne na hustší poměr pro text CJK (čínština, japonština, korejština), kde se znak běžně mapuje tak, aby se blížil jednomu tokenu místo čtvrtiny. Smíšený text je klasifikován znak po znaku, takže odstavec přepínající se mezi angličtinou a japonštinou získá smíšený odhad.

Referenční ceny jsou pevně zakódovány v tom, co každý poskytovatel uvedl v době, kdy byl tento nástroj vytvořen, zobrazeno na milion tokenů. Přepněte "Cena jako výstupní tokeny", chcete-li místo toho ocenit stejný počet podle výstupní sazby každého modelu – cena výstupu je konzistentně vyšší než vstup, což je důležité při odhadování dokončení spíše než výzvy. Tabulka se při psaní aktualizuje, takže oříznutí výzvy ukáže její účinek na každý model najednou.

Vše běží lokálně: text, který vložíte, se nikdy nikam nenahraje, takže je bezpečné jej použít na výzvu obsahující důvěrný materiál. Vzhledem k tomu, že počet tokenů je odhad, zacházejte s čísly jako s pomůckou při plánování – pro přesné vyúčtování zkontrolujte využití, které váš poskytovatel API skutečně hlásí.

Časté dotazy

Jak přesný je odhad tokenu?
Je to heuristika, která se obvykle pohybuje v rozmezí 10–20 % skutečného počtu pro běžnou prózu. Skutečné tokenizéry BPE lze přesně reprodukovat pouze odesláním vlastního slovníku poskytovatele, čemuž se tento nástroj záměrně vyhýbá, aby zůstal lehkým odhadem na straně klienta.
Proč se stejný text odhaduje jinak pro jazyky CJK?
Čínský, japonský a korejský text tokenizuje mnohem hustěji než text v latince – často se blíží jednomu tokenu na znak spíše než jednomu tokenu na čtyři znaky. Nástroj detekuje tyto skripty a použije samostatný poměr, takže odhad zůstane rozumný i pro text ve smíšeném jazyce.
Jsou ceny živé?
Ne. Jsou to pevně zakódované referenční ceny nastavené při sestavení tohoto nástroje, které nebyly získány z žádného rozhraní API. Poskytovatelé ceny pravidelně mění, proto před rozhodnutím o rozpočtu zkontrolujte aktuální cenovou stránku poskytovatele modelu.
Co se změní „Cena jako výstupní tokeny“?
Přepne každý model na svou rychlost výstupních tokenů namísto rychlosti vstupních tokenů. Výstupní tokeny jsou účtovány vyšší sazbou než vstupní tokeny pro každý model v tabulce, takže toto přepínání je užitečné, když odhadujete náklady na vygenerovanou odpověď spíše než výzvu, kterou odesíláte.
Je můj text někde nahrán?
Ne. Odhad tokenu a výpočet nákladů probíhá výhradně ve vašem prohlížeči – nic, co zde vložíte, se neodesílá OpenAI, Anthropic ani žádné jiné službě.