Das Kontextfenster gibt an, wie viel Inhalt ein Modell bei einer Anfrage gleichzeitig berücksichtigen kann. Es wird meist in Tokens gemessen und bestimmt, wie viel Text, Verlauf oder Dokumenteninhalte im aktuellen Verarbeitungsschritt präsent sind.
Ein großes Kontextfenster erlaubt es, längere Dokumente, komplexe Gesprächsverläufe oder umfangreiche Zusammenhänge in einer Anfrage zu berücksichtigen. Dadurch können Antworten konsistenter und vollständiger ausfallen.
Ist das Limit erreicht, werden ältere Inhalte gekürzt oder nicht mehr vollständig berücksichtigt. Deshalb beeinflusst das Kontextfenster direkt, wie gut ein Modell mit langen Inhalten umgehen kann.