Gettone LLM e calcolatore dei costi
Stima quanti token costa un testo incollato sulle API LLM più diffuse.
Gettone LLM e calcolatore dei costi
Incolla una trascrizione di un messaggio, un documento o una chat e questo strumento stima quanti token consumerebbe, quindi li converte in un costo approssimativo in dollari su una manciata di modelli popolari: GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku e Claude Opus. È progettato per rapidi controlli di integrità prima di inviare un grande batch di richieste tramite un'API, non come sostituto degli esatti numeri di utilizzo riportati successivamente dalla dashboard di un provider.
Il conteggio dei token in questo caso è un conteggio euristico, non esatto. I veri tokenizzatori utilizzano la codifica di coppie di byte addestrata su enormi corpora e riprodurre un lato client significherebbe spedire megabyte di tabelle di unione per una funzionalità. Invece, questo strumento applica la regola empirica citata dalla maggior parte dei documenti API - circa quattro caratteri o tre quarti di una parola per token per l'inglese e altre lingue in caratteri latini - e passa a un rapporto più denso per il testo CJK (cinese, giapponese, coreano), dove un carattere normalmente si associa a un token invece che a un quarto. Il testo misto viene classificato carattere per carattere, quindi un paragrafo che passa dall'inglese al giapponese ottiene una stima mista.
I prezzi di riferimento sono codificati in base a quanto elencato da ciascun fornitore al momento della creazione di questo strumento, mostrato per milione di token. Attiva "Prezza come token di output" per valutare invece lo stesso conteggio alla velocità di output di ciascun modello: l'output ha costantemente un prezzo più alto dell'input, il che è importante quando si stima un completamento piuttosto che una richiesta. La tabella si aggiorna durante la digitazione, quindi il taglio di un prompt mostra il suo effetto su ogni modello contemporaneamente.
Tutto funziona localmente: il testo che incolli non viene mai caricato da nessuna parte, quindi è sicuro da usare su un prompt contenente materiale riservato. Poiché il conteggio dei token è una stima, considera i numeri come un aiuto per la pianificazione: per una fatturazione esatta, controlla l'utilizzo effettivamente segnalato dal tuo provider API.