Kontextfenster
Das Kontextfenster gibt an, wie viel Text ein Modell auf einmal berücksichtigen kann — Anweisung, Dokumente, Gesprächsverlauf und Antwort zusammen. Es wird in Tokens gemessen.
Auch bekannt als: Context Window
So funktioniert das
Das Kontextfenster ist das Arbeitsgedächtnis des Modells. Alles, was es für eine Antwort berücksichtigen soll — deine Anweisung, hochgeladene Dokumente, der bisherige Gesprächsverlauf und die Antwort selbst —, muss hineinpassen. Die Größe wird in Tokens angegeben und reicht je nach Modell von einigen tausend bis zu hunderttausenden Tokens und mehr.
Beispiel aus der Praxis
Du möchtest einen langen Vertrag mit einem Modell prüfen. Passt er komplett ins Kontextfenster, kann das Modell ihn als Ganzes lesen. Ist er länger, musst du ihn aufteilen oder per RAG nur die relevanten Stellen übergeben.
Das solltest du wissen
- Ein größeres Fenster bedeutet nicht automatisch bessere Antworten: Bei sehr langen Eingaben werden Details leichter übersehen.
- Mehr Kontext kostet mehr Tokens und damit mehr Geld und Zeit.
- Was außerhalb des Fensters liegt, kennt das Modell nicht — auch nicht aus einem früheren Gespräch, wenn es nicht gespeichert und wieder mitgegeben wird.