Aller au contenu
Tout en local

Jeton LLM et calculateur de coûts

Estimez le nombre de jetons qu'un texte collé coûte dans les API LLM populaires.

Entrée
Sortie

Jeton LLM et calculateur de coûts

Collez une invite, un document ou une transcription de discussion et cet outil estime le nombre de jetons qu'il consommerait, puis le convertit en un coût approximatif en dollars sur une poignée de modèles populaires : GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku et Claude Opus. Il est conçu pour des contrôles d'intégrité rapides avant d'envoyer un grand nombre de requêtes via une API, et non pour remplacer les numéros d'utilisation exacts que le tableau de bord d'un fournisseur rapporte par la suite.

Le comptage de jetons ici est une heuristique et non un décompte exact. Les vrais tokenizers utilisent un codage par paire d'octets formé sur d'énormes corpus, et reproduire un côté client signifierait envoyer des mégaoctets de tables de fusion pour une fonctionnalité. Au lieu de cela, cet outil applique la règle empirique citée par la plupart des documents API – environ quatre caractères ou trois quarts de mot par jeton pour l'anglais et d'autres langues d'écriture latine – et passe à un rapport plus dense pour le texte CJK (chinois, japonais, coréen), où un caractère correspond généralement à près d'un jeton au lieu d'un quart. Le texte mixte est classé caractère par caractère, de sorte qu'un paragraphe basculant entre l'anglais et le japonais obtient une estimation mixte.

Les prix de référence sont codés en dur selon ce que chaque fournisseur a indiqué lors de la création de cet outil, affichés par million de jetons. Activez « Prix en tant que jetons de sortie » pour tarifer le même nombre au taux de sortie de chaque modèle : le prix de la sortie est systématiquement plus élevé que celui de l'entrée, ce qui est important lors de l'estimation d'un achèvement plutôt que d'une invite. Le tableau se met à jour au fur et à mesure que vous tapez, de sorte que le découpage d'une invite affiche son effet sur chaque modèle à la fois.

Tout s'exécute localement : le texte collé n'est jamais téléchargé, donc c'est sûr avec du contenu confidentiel. Le nombre de jetons étant une estimation, utilisez-le comme aide à la planification ; pour une facturation exacte, vérifiez l'usage réel signalé par votre fournisseur d'API.

FAQ

Quelle est la précision de l’estimation symbolique ?
Il s'agit d'une heuristique, généralement comprise entre 10 et 20 % du nombre réel de prose ordinaire. Les vrais tokenizers BPE ne peuvent être reproduits exactement qu'en envoyant le propre vocabulaire du fournisseur, ce que cet outil évite intentionnellement pour rester une estimation légère côté client.
Pourquoi le même texte estime-t-il différemment pour les langues CJK ?
Les textes chinois, japonais et coréens sont symbolisés de manière beaucoup plus dense que les textes latins – souvent proches d'un jeton par caractère plutôt que d'un jeton pour quatre caractères. L'outil détecte ces scripts et applique un ratio distinct afin que l'estimation reste également raisonnable pour les textes multilingues.
Les prix sont-ils en direct ?
Non. Il s’agit de prix de référence codés en dur, définis lors de la création de cet outil, et non extraits d’une API. Les fournisseurs modifient leurs prix périodiquement, alors vérifiez la page de tarification actuelle du fournisseur modèle avant de prendre une décision budgétaire.
Que change le « Prix en tant que jetons de sortie » ?
Il fait passer chaque modèle à son taux de jetons de sortie au lieu de son taux de jetons d'entrée. Les jetons de sortie sont facturés à un tarif plus élevé que les jetons d'entrée pour chaque modèle du tableau. Cette option est donc utile lorsque vous estimez le coût d'une réponse générée plutôt que d'une invite que vous envoyez.
Mon texte est-il téléchargé quelque part ?
L'estimation du jeton et le calcul des coûts s'exécutent entièrement dans votre navigateur : rien de ce que vous collez ici n'est envoyé à OpenAI, Anthropic ou à tout autre service.