Sări la conținut
Complet local

Calculator de costuri și simboluri LLM

Estimați câte simboluri costă un text lipit în API-urile LLM populare.

Intrare
Ieșire

Calculator de costuri și simboluri LLM

Lipiți un prompt, un document sau o transcriere de chat și acest instrument estimează câte jetoane ar consuma, apoi le transformă într-un cost aproximativ în dolari pentru o mână de modele populare - GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku și Claude Opus. Este creat pentru verificări rapide de sănătate înainte de a trimite un lot mare de solicitări printr-un API, nu ca un substitut pentru numerele exacte de utilizare raportate ulterior de tabloul de bord al furnizorului.

Numărarea jetoanelor aici este o euristică, nu o numărare exactă. Tokenizatoarele reale folosesc codificarea perechilor de octeți antrenate pe corpuri uriașe, iar reproducerea unei părți de client ar însemna livrarea de megaocteți de tabele de îmbinare pentru o singură caracteristică. În schimb, acest instrument aplică regula generală a celor mai multe citate din documentele API - aproximativ patru caractere sau trei sferturi de cuvânt pe token pentru engleză și alte limbi cu scripturi latină - și trece la un raport mai dens pentru textul CJK (chineză, japoneză, coreeană), unde un caracter se mapează în mod obișnuit la aproape un simbol în loc de un sfert. Textul mixt este clasificat caracter cu caracter, astfel încât un paragraf care comută între engleză și japoneză obține o estimare combinată.

Prețurile de referință sunt codificate în funcție de ceea ce a enumerat fiecare furnizor atunci când a fost creat acest instrument, afișat pe milion de jetoane. Comutați „Prețul ca simboluri de ieșire” pentru a stabili prețul la același număr la rata de ieșire a fiecărui model - prețul de ieșire este în mod constant mai mare decât de intrare, ceea ce contează atunci când estimați o finalizare, mai degrabă decât un prompt. Tabelul se actualizează pe măsură ce tastați, așa că tăierea unui prompt arată efectul acestuia pe fiecare model simultan.

Totul rulează local: textul pe care îl inserați nu este încărcat niciodată nicăieri, așa că este sigur să îl utilizați la un prompt care conține material confidențial. Deoarece numărul de simboluri este o estimare, tratați numerele ca pe un ajutor de planificare - pentru facturarea exactă, verificați utilizarea pe care o raportează furnizorul dvs. de API.

FAQ

Cât de precisă este estimarea simbolului?
Este o euristică, de obicei în aproximativ 10-20% din numărul real pentru proza obișnuită. Tokenizatoarele BPE reale pot fi reproduse exact doar prin livrarea propriului vocabular al furnizorului, pe care acest instrument îl evită în mod intenționat pentru a rămâne o estimare ușoară, la nivelul clientului.
De ce același text este estimat diferit pentru limbile CJK?
Textele în chineză, japoneză și coreeană sunt mult mai dens decât textul în grafie latină - adesea aproape de un simbol pe caracter, mai degrabă decât un simbol la patru caractere. Instrumentul detectează aceste scripturi și aplică un raport separat, astfel încât estimarea să rămână rezonabilă și pentru textul în diferite limbi.
Preturile sunt live?
Nu. Sunt prețuri de referință codificate, stabilite atunci când acest instrument a fost creat, care nu sunt preluate de la niciun API. Furnizorii modifică periodic prețurile, așa că verificați pagina actuală de prețuri a furnizorului de model înainte de a lua o decizie de buget.
Ce se schimbă „Prețul ca jetoane de ieșire”?
Comută fiecare model la rata sa de jeton de ieșire în loc de rata de jeton de intrare. Jetoanele de ieșire sunt facturate la o rată mai mare decât tokenurile de intrare pentru fiecare model din tabel, astfel încât această comutare este utilă atunci când estimați costul unui răspuns generat, mai degrabă decât o solicitare pe care o trimiteți.
Textul meu este încărcat undeva?
Nu. Estimarea simbolului și calculul costului rulează în întregime în browserul dvs. - nimic din ceea ce lipiți aici nu este trimis către OpenAI, Anthropic sau orice alt serviciu.