Token-Zähler für KI-Prompts

Fügen Sie Ihren Prompt oder Text ein und sehen Sie eine Schätzung der Token-Anzahl mit realistischer Spanne. Die Werte beruhen auf Messungen mit OpenAI-Tokenizern für die gewählte Textsprache. Ihr Text bleibt im Browser.

Einfügen mit Strg+V. Gezählt wird live beim Tippen.

Ihr Text bleibt in Ihrem Browser – er wird nicht gesendet, nicht gespeichert und nicht in die Adresszeile geschrieben.

Deutsch braucht bei gleicher Zeichenzahl rund 15 % mehr Tokens als Englisch.

Ergebnis

Geschätzte Tokens
≈ 85
Übliche Spanne
68 bis 104 Tokens
Zeichen
284
Zeichen ohne Leerzeichen
243
Wörter
41
Zeilen
3
Schätzung, keine exakte Zählung: Jedes KI-Modell zerlegt Text mit seinem eigenen Tokenizer. Die Spanne deckte 80–90 % unserer Messtexte ab (OpenAI o200k_base und cl100k_base).

So wird gerechnet

Tokens sind die Einheiten, in die ein Sprachmodell Text zerlegt – ganze Wörter, Wortteile, Satzzeichen oder Leerzeichen. Abgerechnet und begrenzt (Kontextfenster, maximale Antwortlänge) wird in Tokens, nicht in Zeichen.

Faustregel: rund 4 Zeichen pro Token – im Englischen

OpenAI schreibt zu seinem Tokenizer tiktoken, ein Token entspreche im Schnitt etwa 4 Bytes; Google nennt für Gemini „etwa 4 Zeichen“ pro Token. Beides gilt für englischen Text. Andere Sprachen brauchen mehr Tokens, weil die Tokenizer überwiegend mit englischem Text trainiert wurden und Wörter wie „Stadtbibliothek“ in mehrere Teile zerfallen.

Woher die Zahlen kommen

Wir haben die OpenAI-Tokenizer o200k_base (GPT-4o und neuer) und cl100k_base (GPT-4, GPT-3.5) auf 39 bis 56 Fließtexten je Sprache gemessen (Stand 27.09.2026). Zeichen pro Token im Mittel:

Die Schätzung teilt die Zeichenzahl durch den Mittelwert beider Tokenizer; die Spanne nutzt das 10.- und 90.-Perzentil der Einzeltexte. Programmcode, Tabellen, viele Zahlen, Emoji oder Sprachen mit anderen Schriften (Chinesisch, Arabisch …) können deutlich abweichen.

Warum kein exakter Zähler?

Ein exakter Tokenizer müsste die komplette Token-Tabelle laden – für o200k_base sind das rund 3,6 MB. Das wäre für eine schnelle Seite unverhältnismäßig. Claude, Gemini und Llama verwenden zudem eigene Tokenizer; exakte Zahlen liefert nur der jeweilige Anbieter (z. B. per Token-Counting-Schnittstelle).

Häufige Fragen

Wie viele Tokens sind 1.000 Wörter?

Im Englischen etwa 1.300–1.400 Tokens (gemessen: im Mittel 1,4 Tokens pro Wort). Deutsch braucht mehr: je nach Tokenizer etwa 1,8–2,1 Tokens pro Wort, also rund 1.800–2.100 Tokens.

Ist die Zählung für ChatGPT genau?

Nein, es ist eine Schätzung auf Basis von Messungen mit den ChatGPT-Tokenizern. In unseren Messtexten lagen 80–90 % der echten Werte in der angezeigten Spanne; die Mitte wich im Median um 6–12 % ab.

Gilt das auch für Claude oder Gemini?

Grob ja, aber jedes Modell hat einen eigenen Tokenizer. Google nennt für Gemini ebenfalls etwa 4 Zeichen pro Token im Englischen. Exakte Zahlen erhalten Sie nur über die Schnittstelle des jeweiligen Anbieters.

Wird mein Text hochgeladen?

Nein. Gezählt wird nur in Ihrem Browser, der Text wird nicht gesendet, nicht gespeichert und nicht in die Adresszeile geschrieben.

Warum zählen Leerzeichen und Zeilenumbrüche mit?

Tokenizer verarbeiten auch Leerraum: Ein Leerzeichen hängt meist am folgenden Wort, mehrere Leerzeichen oder Umbrüche ergeben eigene Tokens. Deshalb geht die Schätzung von allen Zeichen aus.

Quellen und Rechtsgrundlagen

Stand:

Passende Werkzeuge