Vai al contenuto
100% locale

Gettone LLM e calcolatore dei costi

Stima quanti token costa un testo incollato sulle API LLM più diffuse.

Ingresso
Uscita

Gettone LLM e calcolatore dei costi

Incolla una trascrizione di un messaggio, un documento o una chat e questo strumento stima quanti token consumerebbe, quindi li converte in un costo approssimativo in dollari su una manciata di modelli popolari: GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku e Claude Opus. È progettato per rapidi controlli di integrità prima di inviare un grande batch di richieste tramite un'API, non come sostituto degli esatti numeri di utilizzo riportati successivamente dalla dashboard di un provider.

Il conteggio dei token in questo caso è un conteggio euristico, non esatto. I veri tokenizzatori utilizzano la codifica di coppie di byte addestrata su enormi corpora e riprodurre un lato client significherebbe spedire megabyte di tabelle di unione per una funzionalità. Invece, questo strumento applica la regola empirica citata dalla maggior parte dei documenti API - circa quattro caratteri o tre quarti di una parola per token per l'inglese e altre lingue in caratteri latini - e passa a un rapporto più denso per il testo CJK (cinese, giapponese, coreano), dove un carattere normalmente si associa a un token invece che a un quarto. Il testo misto viene classificato carattere per carattere, quindi un paragrafo che passa dall'inglese al giapponese ottiene una stima mista.

I prezzi di riferimento sono codificati in base a quanto elencato da ciascun fornitore al momento della creazione di questo strumento, mostrato per milione di token. Attiva "Prezza come token di output" per valutare invece lo stesso conteggio alla velocità di output di ciascun modello: l'output ha costantemente un prezzo più alto dell'input, il che è importante quando si stima un completamento piuttosto che una richiesta. La tabella si aggiorna durante la digitazione, quindi il taglio di un prompt mostra il suo effetto su ogni modello contemporaneamente.

Tutto funziona localmente: il testo che incolli non viene mai caricato da nessuna parte, quindi è sicuro da usare su un prompt contenente materiale riservato. Poiché il conteggio dei token è una stima, considera i numeri come un aiuto per la pianificazione: per una fatturazione esatta, controlla l'utilizzo effettivamente segnalato dal tuo provider API.

FAQ

Quanto è accurata la stima del token?
È un'euristica, tipicamente entro circa il 10-20% del conteggio reale della prosa ordinaria. I token BPE reali possono essere riprodotti esattamente solo trasmettendo il vocabolario del provider, cosa che questo strumento evita intenzionalmente per rimanere una stima leggera, lato client.
Perché lo stesso testo stima diversamente per le lingue CJK?
Il testo cinese, giapponese e coreano viene tokenizzato in modo molto più denso rispetto al testo in caratteri latini, spesso vicino a un token per carattere anziché a un token per quattro caratteri. Lo strumento rileva questi script e applica un rapporto separato in modo che la stima rimanga ragionevole anche per il testo in lingue miste.
I prezzi sono in tempo reale?
No. Si tratta di prezzi di riferimento codificati impostati al momento della creazione di questo strumento, non recuperati da alcuna API. I fornitori modificano periodicamente i prezzi, quindi controlla la pagina dei prezzi attuali del fornitore del modello prima di prendere una decisione sul budget.
Cosa cambia nel "Prezzo come token di output"?
Cambia ogni modello alla sua velocità di token di output invece che alla sua velocità di token di input. I token di output vengono fatturati a una tariffa più elevata rispetto ai token di input per ogni modello nella tabella, quindi questa opzione è utile quando si stima il costo di una risposta generata anziché di un prompt che si sta inviando.
Il mio testo è caricato da qualche parte?
No. La stima del token e il calcolo dei costi vengono eseguiti interamente nel tuo browser: nulla di ciò che incolli qui viene inviato a OpenAI, Anthropic o qualsiasi altro servizio.