Zum Inhalt springen
100% lokal

LLM-Token und Kostenrechner

Schätzen Sie, wie viele Token ein eingefügter Text über gängige LLM-APIs hinweg kostet.

Eingabe
Ausgabe

LLM-Token und Kostenrechner

Fügen Sie eine Eingabeaufforderung, ein Dokument oder ein Chat-Transkript ein und dieses Tool schätzt, wie viele Token es verbrauchen würde, und rechnet diese dann in ungefähre Dollarkosten für eine Handvoll beliebter Modelle um – GPT-4o, GPT-4o mini, Claude Sonnet, Claude Haiku und Claude Opus. Es ist für schnelle Plausibilitätsprüfungen konzipiert, bevor eine große Anzahl von Anfragen über eine API gesendet wird, und nicht als Ersatz für die genauen Nutzungszahlen, die das Dashboard eines Anbieters anschließend meldet.

Bei der Token-Zählung handelt es sich hier um eine Heuristik, nicht um eine exakte Zählung. Echte Tokenizer verwenden eine Bytepaar-Codierung, die auf riesigen Korpora trainiert wurde, und die Reproduktion einer Clientseite würde den Versand von Megabytes an Zusammenführungstabellen für eine Funktion bedeuten. Stattdessen wendet dieses Tool die Faustregel an, die in den meisten API-Dokumenten zitiert wird – ungefähr vier Zeichen oder drei Viertel eines Wortes pro Token für Englisch und andere Sprachen mit lateinischer Schrift – und wechselt zu einem dichteren Verhältnis für CJK-Text (Chinesisch, Japanisch, Koreanisch), bei dem ein Zeichen normalerweise einem Token statt einem Viertel entspricht. Gemischter Text wird Zeichen für Zeichen klassifiziert, sodass ein Absatz, der zwischen Englisch und Japanisch wechselt, eine gemischte Schätzung erhält.

Die Referenzpreise sind fest codiert und basieren auf den Angaben jedes Anbieters zum Zeitpunkt der Entwicklung dieses Tools. Sie werden pro Million Token angezeigt. Schalten Sie „Als Ausgabe-Tokens bepreisen“ um, um stattdessen die gleiche Anzahl bei der Ausgaberate jedes Modells zu bepreisen – die Ausgabe wird durchweg höher bewertet als die Eingabe, was bei der Schätzung einer Fertigstellung und nicht einer Eingabeaufforderung von Bedeutung ist. Die Tabelle wird während der Eingabe aktualisiert, sodass das Zuschneiden einer Eingabeaufforderung seine Auswirkungen auf alle Modelle gleichzeitig zeigt.

Alles läuft lokal: Der von Ihnen eingefügte Text wird nirgendwo hochgeladen, daher ist die Verwendung bei einer Eingabeaufforderung mit vertraulichem Material sicher. Da es sich bei der Token-Anzahl um eine Schätzung handelt, betrachten Sie die Zahlen als Planungshilfe – für eine genaue Abrechnung überprüfen Sie die tatsächlich von Ihrem API-Anbieter gemeldete Nutzung.

Häufige Fragen

Wie genau ist die Token-Schätzung?
Es handelt sich um eine Heuristik, die typischerweise innerhalb von etwa 10–20 % der tatsächlichen Zählung für gewöhnliche Prosa liegt. Echte BPE-Tokenizer können nur durch die Bereitstellung des eigenen Vokabulars des Anbieters exakt reproduziert werden, was dieses Tool bewusst vermeidet, um eine einfache, kundenseitige Schätzung zu bleiben.
Warum wird derselbe Text für CJK-Sprachen unterschiedlich geschätzt?
Chinesischer, japanischer und koreanischer Text wird weitaus dichter in Tokens unterteilt als lateinischer Text – oft liegt er bei etwa einem Token pro Zeichen und nicht bei einem Token pro vier Zeichen. Das Tool erkennt diese Skripte und wendet ein separates Verhältnis an, sodass die Schätzung auch für gemischtsprachigen Text angemessen bleibt.
Sind die Preise live?
Nein. Es handelt sich um fest codierte Referenzpreise, die bei der Erstellung dieses Tools festgelegt und nicht von einer API abgerufen wurden. Anbieter ändern die Preise regelmäßig. Sehen Sie sich daher die aktuelle Preisseite des Modellanbieters an, bevor Sie eine Budgetentscheidung treffen.
Was ändert sich beim „Preis als Ausgabe-Token“?
Es schaltet jedes Modell auf seine Ausgabe-Token-Rate statt auf seine Eingabe-Token-Rate um. Ausgabe-Tokens werden für jedes Modell in der Tabelle zu einem höheren Preis in Rechnung gestellt als Eingabe-Tokens. Daher ist dieser Schalter nützlich, wenn Sie die Kosten einer generierten Antwort und nicht einer von Ihnen gesendeten Eingabeaufforderung abschätzen.
Wird mein Text irgendwo hochgeladen?
Nein. Die Token-Schätzung und die Kostenberechnung laufen vollständig in Ihrem Browser – nichts, was Sie hier einfügen, wird an OpenAI, Anthropic oder einen anderen Dienst gesendet.