Zum Inhalt springen
22. September 2026 · Ausgabe 09/26 Immer aktuell
Digital & KI

Kontextverfall: Warum ChatGPT mitten im Chat vergisst

Lange Chats mit KI-Tools wie ChatGPT oder Claude liefern irgendwann schlechtere Ergebnisse. Der Grund ist technisch, die Lösung ist einfach.

Kontextverfall: Warum ChatGPT mitten im Chat vergisst
Symbolbild zur Meldung. Bild: KI-generiert

Wer regelmäßig mit KI-Tools arbeitet, kennt das Problem. Der Chat läuft seit einer Stunde. Die Anweisungen waren klar. Trotzdem ignoriert die KI plötzlich Formatvorgaben, vergisst Rahmenbedingungen oder liefert Texte, die zu lang sind. Das Modell ist nicht kaputt. Es ist voll.

Das Kontextfenster: Die wichtigste Grenze, die kaum jemand kennt

Jedes KI-Sprachmodell, also ChatGPT, Claude oder Gemini, arbeitet mit einem sogenannten Kontextfenster. Das ist die maximale Textmenge, die das Modell in einem Gespräch gleichzeitig verarbeiten kann. Dazu zählen alle Eingaben des Nutzers und alle Antworten des Modells.

Ist dieses Fenster voll, fallen ältere Gesprächsteile heraus. Das Modell "erinnert" sich dann nicht mehr an frühe Anweisungen. Es fehlt schlicht der Platz dafür.

Dieses Phänomen hat einen Namen: "Context Rot", auf Deutsch Kontextverfall. Der Begriff beschreibt den schleichenden Informationsverlust bei langen Sitzungen. Er ist kein Fehler des Nutzers, sondern eine technische Eigenschaft aller aktuellen Sprachmodelle.

Warum das für kleine Unternehmen ein echtes Problem ist

Wer KI-Tools für Texte, Angebote, Kundenkorrespondenz oder interne Dokumente nutzt, arbeitet oft in langen Sitzungen. Man verfeinert Prompts, gibt Feedback, ergänzt Informationen. Genau das füllt das Kontextfenster schnell.

Das Ergebnis: Die KI liefert nach einer Stunde andere Outputs als nach zehn Minuten, obwohl sich die Aufgabe nicht geändert hat. Wer das nicht weiß, sucht den Fehler bei sich oder beim Prompt. Beides ist falsch.

Wie voll ist das Kontextfenster gerade?

Die KI selbst kann das nicht zuverlässig beantworten. Fragt man sie danach, riskiert man eine halluzinierte Schätzung. Die Frage fügt außerdem noch mehr Kontext hinzu und verschlimmert das Problem.

Ein einfacher Workaround: Man gibt zu Beginn eines Chats die Anweisung, jeden Antworttext mit dem eigenen Namen zu beginnen. Fehlt der Name irgendwann, ist das ein deutliches Signal. Das Kontextfenster ist wahrscheinlich voll. Die frühe Anweisung wurde verdrängt.

Das ist keine exakte Messung, aber ein brauchbares Frühwarnsystem für den Arbeitsalltag.

Was zu tun ist, wenn das Fenster voll ist

Der sauberste Weg ist ein Neustart mit strukturierter Übergabe. Bevor man den Chat wechselt, lässt man die KI eine kompakte Zusammenfassung erstellen. Diese sollte das Ziel der Arbeit, alle getroffenen Entscheidungen, den aktuellen Stand und die nächsten Schritte enthalten.

Diese Zusammenfassung kopiert man in einen neuen Chat und fügt die ursprünglichen Kernanweisungen erneut hinzu. So beginnt das Modell mit einem vollen Arbeitsgedächtnis statt einem überfüllten.

Vorbeugen statt reparieren

Wer regelmäßig mit KI arbeitet, sollte lange Sitzungen grundsätzlich vermeiden. Besser ist es, Aufgaben in kleinere Einheiten zu teilen und für jede Einheit einen eigenen Chat zu starten.

Es lohnt sich außerdem, einen sogenannten Kontext-Block vorzubereiten: ein kurzes Textdokument mit den wichtigsten Rahmenbedingungen, Tonalität, Formatvorgaben und Projektzielen. Diesen Block fügt man zu Beginn jedes neuen Chats ein. Das kostet wenige Sekunden und spart oft viele Minuten Fehlersuche.

Fazit

KI-Tools werden nicht schlechter, wenn man sie länger nutzt. Sie stoßen an eine technische Grenze. Wer das weiß, kann damit umgehen. Für kleine Unternehmen, die KI fest in ihre Abläufe integriert haben, ist dieser Umgang kein optionaler Tipp, sondern ein Grundprinzip für verlässliche Ergebnisse.

Ähnliche Beiträge