Ein Token ist die kleinste Texteinheit, mit der ein KI-Sprachmodell arbeitet – meist ein Wort, ein Wortteil oder ein Satzzeichen. Bevor ein LLM deinen Text verarbeitet, zerlegt es ihn in solche Tokens; auch die Antwort entsteht Token für Token.
Wie viel Text ist ein Token?
Als Faustregel gilt: Ein Token entspricht im Englischen etwa 4 Zeichen oder ¾ eines Wortes. Deutsche Texte brauchen wegen der langen zusammengesetzten Wörter oft etwas mehr Tokens. Beispiel: „Künstliche Intelligenz“ wird je nach Modell in 3 bis 6 Tokens zerlegt – etwa „K“, „ünstliche“, „ Intelligenz“. Eine DIN-A4-Seite Text sind grob 500 bis 800 Tokens.
Warum Tokens wichtig sind
- Kosten: Wer KI über die API nutzt, zahlt pro Token – getrennt für Eingabe (Input) und Ausgabe (Output). Die Preise werden meist pro Million Tokens angegeben.
- Längenlimit: Das Kontextfenster eines Modells wird in Tokens gemessen. Ist es voll, „vergisst“ das Modell den Anfang oder bricht ab.
- Geschwindigkeit: Auch die Ausgabegeschwindigkeit wird in Tokens pro Sekunde gemessen.
Praxis-Tipp
Im Chat (ChatGPT, Claude & Co.) musst du Tokens selten selbst zählen – dort zahlst du pauschal per Abo. Relevant werden Tokens vor allem, wenn du KI über die API in eigene Abläufe einbaust oder sehr lange Dokumente verarbeitest. Die Anbieter stellen dafür kostenlose Token-Zähler (Tokenizer) bereit, mit denen du deinen Text vorab prüfen kannst.