İçeriğe atla
%100 yerel

LLM jetonu ve maliyet hesaplayıcısı

Popüler LLM API'lerinde yapıştırılan bir metnin kaç jetona mal olacağını tahmin edin.

Giriş
Çıkış

LLM jetonu ve maliyet hesaplayıcısı

Bir bilgi istemi, belge veya sohbet metnini yapıştırın ve bu araç, ne kadar jeton tüketeceğini tahmin eder ve ardından bunu bir avuç popüler modelde (GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku ve Claude Opus) yaklaşık dolar maliyetine dönüştürür. Bir sağlayıcının kontrol panelinin daha sonra rapor ettiği kesin kullanım sayılarının yerine geçmek için değil, bir API aracılığıyla büyük miktarda istek göndermeden önce hızlı sağlık kontrolleri için tasarlanmıştır.

Burada jeton sayımı kesin bir sayım değil buluşsal bir yöntemdir. Gerçek belirteçler, büyük şirketler üzerinde eğitilmiş bayt çifti kodlamayı kullanır ve bir istemci tarafının yeniden üretilmesi, bir özellik için megabaytlarca birleştirme tablosunun gönderilmesi anlamına gelir. Bunun yerine, bu araç, çoğu API belgesinde alıntı yapılan temel kuralı uygular (İngilizce ve diğer Latin alfabesi dilleri için simge başına kabaca dört karakter veya bir kelimenin dörtte üçü) ve bir karakterin genellikle çeyrek yerine bir simgeye yakın olarak eşleştiği CJK metni (Çince, Japonca, Korece) için daha yoğun bir orana geçer. Karışık metin, karakter karakter olarak sınıflandırılır, böylece İngilizce ile Japonca arasında geçiş yapan bir paragraf, karma bir tahmin alır.

Referans fiyatları, bu araç geliştirildiğinde her sağlayıcının listelediği, milyon token başına gösterilen şekilde kodlanmıştır. Bunun yerine, her modelin çıktı oranında aynı sayıyı fiyatlandırmak için "Çıktı belirteçleri olarak fiyatlandır" seçeneğini değiştirin; çıktı, sürekli olarak girdiden daha yüksek fiyatlandırılır; bu, bir istem yerine tamamlanmayı tahmin ederken önemlidir. Tablo siz yazdıkça güncellenir, böylece bir istemin kırpılması etkisini her modelde aynı anda gösterir.

Her şey yerel olarak çalışır: yapıştırdığınız metin hiçbir zaman hiçbir yere yüklenmez, bu nedenle gizli materyal içeren bir bilgi isteminde kullanmak güvenlidir. Belirteç sayısı bir tahmin olduğundan, sayıları planlamaya yardımcı olarak değerlendirin; tam faturalandırma için API sağlayıcınızın gerçekte bildirdiği kullanımı kontrol edin.

FAQ

Token tahmini ne kadar doğrudur?
Bu, sıradan düzyazı için tipik olarak gerçek sayının yaklaşık %10-20'si dahilinde olan bir buluşsal yöntemdir. Gerçek BPE belirteçleri yalnızca sağlayıcının kendi sözlüğünü göndererek tam olarak çoğaltılabilir; bu araç, hafif, müşteri tarafı bir tahmin olarak kalmaktan kasıtlı olarak kaçınır.
Aynı metin neden CJK dilleri için farklı tahminlerde bulunuyor?
Çince, Japonca ve Korece metinler, Latin harfli metinlerden çok daha yoğun bir şekilde simgeleşir; genellikle dört karakter başına bir simge yerine, karakter başına bir simgeye yakındır. Araç, bu komut dosyalarını algılar ve ayrı bir oran uygular; böylece tahmin, karma dilli metinler için de makul kalır.
Fiyatlar canlı mı?
Hayır. Bunlar, herhangi bir API'den alınmayan, bu araç geliştirildiğinde belirlenen sabit kodlu referans fiyatlardır. Sağlayıcılar fiyatlandırmayı periyodik olarak değiştirdiğinden, bütçeleme kararı vermeden önce model sağlayıcının mevcut fiyatlandırma sayfasını kontrol edin.
"Çıktı belirteçleri olarak fiyat" neyi değiştirir?
Her modeli giriş jetonu oranı yerine çıkış jetonu oranına geçirir. Çıkış belirteçleri, tablodaki her model için giriş belirteçlerinden daha yüksek bir oranda faturalandırılır; dolayısıyla, bu geçiş, gönderdiğiniz bir bilgi istemi yerine oluşturulan bir yanıtın maliyetini tahmin ederken kullanışlıdır.
Metnim herhangi bir yere yüklendi mi?
Hayır. Token tahmini ve maliyet hesaplaması tamamen tarayıcınızda çalışır; buraya yapıştırdığınız hiçbir şey OpenAI, Anthropic veya başka bir hizmete gönderilmez.