Tokenisierung - wie ein LLM Text in Token zerlegt
Tokenisierung zerlegt Text in Token - die kleinen Einheiten, mit denen ein LLM rechnet. Ein Token ist meist ein Wortteil, kein ganzes Wort.
Ein Sprachmodell verarbeitet keinen Text im menschlichen Sinne, sondern Zahlen. Bevor eine Eingabe ein LLM überhaupt erreicht, wird sie deshalb in Token zerlegt - diesen Schritt nennt man Tokenisierung. Ein Token ist die kleinste Einheit, mit der das Modell arbeitet: mal ein ganzes kurzes Wort, oft aber nur ein Wortteil, eine Silbe oder ein Satzzeichen. Als grobe Faustregel entspricht ein Token im Deutschen und Englischen ungefähr einem Dreiviertelwort - lange oder seltene Wörter werden in mehrere Token gesplittet.
Warum nicht einfach Wörter?
Würde ein Modell mit ganzen Wörtern arbeiten, bräuchte es für jede denkbare Wortform einen eigenen Eintrag - unmöglich bei Millionen Varianten, Tippfehlern und Fremdsprachen. Token-Verfahren zerlegen den Text stattdessen in einen begrenzten, wiederverwendbaren Vorrat an Bausteinen. So kann das Modell auch nie gesehene Wörter aus bekannten Teilen zusammensetzen.
- Häufige Wörter bleiben oft ein einziges Token.
- Seltene oder zusammengesetzte Wörter zerfallen in mehrere Token - deutsche Komposita wie "Donaudampfschifffahrt" ergeben besonders viele.
- Leerzeichen und Satzzeichen sind ebenfalls Teil der Token.
Konzept, nicht Kosten - die Abgrenzung
Wichtig ist die Unterscheidung: Dieser Begriff erklärt das Konzept - wie und warum Text in Token zerlegt wird. Was die Verarbeitung dieser Token dann im Betrieb kostet, behandelt ein eigener Begriff: Token-Kosten. Denn API-Anbieter rechnen pro Token ab - Ein- und Ausgabe zusammen. Wie viele Token ein Text ergibt, ist damit direkt kostenrelevant, und die Inferenzkosten hängen unmittelbar an dieser Zählung.
Wo Tokenisierung überall greift
Die Tokenzahl bestimmt nicht nur die Kosten, sondern auch, wie viel Text überhaupt in das Kontextfenster passt - denn dessen Grenze wird in Token gemessen, nicht in Zeichen. Auch die Länge einer Antwort und die Verarbeitungsgeschwindigkeit hängen an der Zahl der Token. Tokenisierung ist damit ein unscheinbarer, aber grundlegender Baustein jeder LLM-Anwendung.
Tokenisierung bei Elasticbrains
Wer Token versteht, kann Prompts, Kontext und Modellwahl bewusst so gestalten, dass eine Anwendung effizient und bezahlbar bleibt. Genau hier setzen wir an: Wir analysieren den Tokenverbrauch Ihrer Anwendung und senken die laufenden Kosten. Mehr dazu auf unserer Leistungsseite KI-Kosten-Optimierung.
Häufige Fragen
Was ist ein Token bei einem LLM?
Was ist Tokenisierung?
Was ist der Unterschied zwischen Tokenisierung und Token-Kosten?
Warum arbeiten Modelle mit Token statt mit ganzen Wörtern?
Weitere Glossarbegriffe
Prompt Engineering - Effektive Kommunikation mit KI
Prompt Engineering ist die Kunst, effektive Anweisungen für KI-Modelle zu formulieren - mit Techniken wie Zero-Shot, Few-Shot und Chain-of-Thought.
n8n & DSGVO
n8n lässt sich self-hosted und quelloffen betreiben - dadurch bleiben die Daten im Haus, was DSGVO-konforme Automatisierung ohne fremde Cloud ermöglicht.
Künstliche Intelligenz (KI)
Teilgebiet der Informatik, das sich mit der Automatisierung intelligenten Verhaltens und dem maschinellen Lernen befasst.
Bereit, das in die Praxis zu bringen?
Lassen Sie uns in einem kostenlosen Erstgespräch über Ihr Vorhaben sprechen - unverbindlich und konkret.