LLM-Token und Kostenrechner
Schätzen Sie, wie viele Token ein eingefügter Text über gängige LLM-APIs hinweg kostet.
LLM-Token und Kostenrechner
Fügen Sie eine Eingabeaufforderung, ein Dokument oder ein Chat-Transkript ein und dieses Tool schätzt, wie viele Token es verbrauchen würde, und rechnet diese dann in ungefähre Dollarkosten für eine Handvoll beliebter Modelle um – GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku und Claude Opus. Es ist für schnelle Plausibilitätsprüfungen konzipiert, bevor eine große Anzahl von Anfragen über eine API gesendet wird, und nicht als Ersatz für die genauen Nutzungszahlen, die das Dashboard eines Anbieters anschließend meldet.
Bei der Token-Zählung handelt es sich hier um eine Heuristik, nicht um eine exakte Zählung. Echte Tokenizer verwenden eine Bytepaar-Codierung, die auf riesigen Korpora trainiert wurde, und die Reproduktion einer Clientseite würde den Versand von Megabytes an Zusammenführungstabellen für eine Funktion bedeuten. Stattdessen wendet dieses Tool die Faustregel an, die in den meisten API-Dokumenten zitiert wird – ungefähr vier Zeichen oder drei Viertel eines Wortes pro Token für Englisch und andere Sprachen mit lateinischer Schrift – und wechselt zu einem dichteren Verhältnis für CJK-Text (Chinesisch, Japanisch, Koreanisch), bei dem ein Zeichen normalerweise einem Token statt einem Viertel entspricht. Gemischter Text wird Zeichen für Zeichen klassifiziert, sodass ein Absatz, der zwischen Englisch und Japanisch wechselt, eine gemischte Schätzung erhält.
Die Referenzpreise sind fest codiert und basieren auf den Angaben jedes Anbieters zum Zeitpunkt der Entwicklung dieses Tools. Sie werden pro Million Token angezeigt. Schalten Sie „Als Ausgabe-Tokens bepreisen“ um, um stattdessen die gleiche Anzahl bei der Ausgaberate jedes Modells zu bepreisen – die Ausgabe wird durchweg höher bewertet als die Eingabe, was bei der Schätzung einer Fertigstellung und nicht einer Eingabeaufforderung von Bedeutung ist. Die Tabelle wird während der Eingabe aktualisiert, sodass das Zuschneiden einer Eingabeaufforderung seine Auswirkungen auf alle Modelle gleichzeitig zeigt.
Alles läuft lokal: Der von Ihnen eingefügte Text wird nirgendwo hochgeladen, daher ist die Verwendung bei einer Eingabeaufforderung mit vertraulichem Material sicher. Da es sich bei der Token-Anzahl um eine Schätzung handelt, betrachten Sie die Zahlen als Planungshilfe – für eine genaue Abrechnung überprüfen Sie die tatsächlich von Ihrem API-Anbieter gemeldete Nutzung.