Sprachmodelle zerlegen Texte in kleine Einheiten, sogenannte Tokens, damit sie Sprache rechnerisch verarbeiten können. Diese Einheiten bilden die Grundlage für Eingabe, Ausgabe und Kostenberechnung.
Die Anzahl der Tokens beeinflusst, wie viel ein Modell gleichzeitig verarbeiten kann und wie teuer eine Anfrage wird. Sie spielt daher für Kontextfenster, Leistung und Nutzungskosten eine zentrale Rolle.
Lange Dokumente, ausführliche Prompts oder große Antworten erhöhen die Tokenzahl. Wer mit KI arbeitet, sollte deshalb ein Grundverständnis dafür haben, wie Texte intern verarbeitet werden.