Der Einstieg läuft gut: Der Assistent versteht die Aufgabe, liefert brauchbaren Code, hält sich an Konventionen. Nach einer Stunde Arbeit im selben Chat sieht das Bild anders aus. Vorgaben aus den ersten Nachrichten tauchen nicht mehr auf, bereits korrigierte Fehler kommen zurück, Antworten werden allgemeiner. Der Verdacht fällt schnell auf das Modell – tatsächlich liegt das Problem häufig im Kontextfenster.
Was das Kontextfenster ist
Das Kontextfenster ist der Arbeitsspeicher eines Sprachmodells: die Menge an Text, die es bei der Erzeugung einer Antwort gleichzeitig berücksichtigen kann. Dazu zählt alles, was in der Sitzung angefallen ist – Systemanweisungen, Ihre Prompts, sämtliche bisherigen Antworten, eingefügte Dateien, Logs, Fehlermeldungen.
Dieses Fenster ist endlich. Wird es voll, muss etwas weichen. Je nach Werkzeug geschieht das durch Abschneiden älterer Nachrichten, durch automatische Zusammenfassungen oder durch andere Auswahlmechanismen. Gemeinsam ist allen Varianten: Der Informationsverlust passiert im Hintergrund und ohne Ihr Zutun. Sie sehen im Chatverlauf weiterhin Ihre ursprüngliche Anweisung – das Modell berücksichtigt sie möglicherweise nicht mehr.
Woran Sie es erkennen
Der Wechsel kommt selten abrupt. Typische Anzeichen, die sich in der Praxis beobachten lassen:
- Regeln, die zu Beginn festgelegt wurden – Namenskonventionen, Framework-Version, Zielverzeichnisse – werden ignoriert.
- Bereits gelöste Probleme werden erneut vorgeschlagen, teils mit demselben Fehler.
- Antworten werden auffällig generisch und beziehen sich nicht mehr auf Ihren konkreten Code.
- Der Assistent fragt nach Informationen, die Sie längst geliefert haben.
- Änderungen betreffen Dateien oder Stellen, die gar nicht Thema waren.
Wenn zwei oder drei dieser Punkte zusammenkommen, hilft weiteres Nachbessern im selben Chat meist nicht. Im Gegenteil: Jede zusätzliche Nachricht verbraucht Kontext und verschärft die Lage.
Gegensteuern statt nachkorrigieren
Die wirksamste Maßnahme ist unspektakulär: Sitzungen bewusst beenden. Ein neuer Chat pro abgegrenzter Aufgabe ist in der Regel verlässlicher als eine Sitzung, die einen ganzen Arbeitstag mitschleppt. Der Aufwand für den Neustart ist geringer als die Zeit, die das Debuggen halbgarer Antworten kostet.
Damit der Neustart schnell geht, lohnt sich ein kurzer, wiederverwendbarer Einstiegs-Prompt: Projektkontext, Technologie-Stack, verbindliche Konventionen, aktueller Stand. Dieses Briefing lässt sich als Datei im Repository pflegen und in jede neue Sitzung kopieren. Viele Assistenten unterstützen dafür auch Projektregeln oder Instruktionsdateien, die automatisch mitgegeben werden – das ist stabiler, als sich auf den Gesprächsverlauf zu verlassen.
Weitere Punkte, die sich bewährt haben:
- Nur relevanten Code einfügen. Ganze Dateien oder komplette Logs füllen das Fenster schneller, als der Nutzen rechtfertigt. Auszüge mit der betroffenen Stelle genügen häufig.
- Zwischenstände sichern. Bevor Sie einen Chat schließen, lassen Sie den aktuellen Stand und offene Punkte zusammenfassen. Diese Zusammenfassung wandert in den nächsten Chat – oder besser in Ticket, Commit-Nachricht oder Dokumentation.
- Aufgaben klein schneiden. Eine Sitzung für ein Refactoring, eine für die Tests, eine für die Migration. Das begrenzt nicht nur den Kontext, sondern auch den Prüfaufwand.
- Wichtige Vorgaben wiederholen. Was unbedingt gelten muss, gehört in den unmittelbar vorangehenden Prompt, nicht in Nachricht drei von vierzig.
Größere Fenster lösen das Problem nicht vollständig
Die verfügbaren Kontextgrößen sind in den vergangenen Generationen deutlich gewachsen, und das verschiebt die Grenze spürbar nach hinten. Verschwunden ist sie damit nicht. Mehr Kontext bedeutet auch mehr Material, in dem die tatsächlich relevanten Angaben untergehen können – ein voller Arbeitsspeicher voller Nebensächlichkeiten ist kein besserer Arbeitsspeicher. Die Disziplin, gezielt auszuwählen, was das Modell sehen soll, bleibt damit Teil der Arbeit.
Organisatorische Konsequenz
Für Teams heißt das: Der Umgang mit Kontext gehört in die Arbeitsweise, nicht in die Kategorie persönlicher Marotten. Ein gemeinsames Projekt-Briefing, eine Konvention für Sitzungsgrenzen und die Regel, Ergebnisse außerhalb des Chatverlaufs festzuhalten, kosten wenig und verhindern eine ganze Klasse von Reibungsverlusten. Wer stattdessen ausschließlich über Prompt-Formulierungen diskutiert, behandelt das Symptom.
Für Web- und Softwareprojekte bedeutet das vor allem eines: KI-Assistenten sind produktiv, wenn sie in klar abgegrenzten Aufgaben eingesetzt werden – nicht in endlosen Sitzungen. Der Projektkontext gehört ins Repository und in die Dokumentation, wo er versioniert und für alle nachvollziehbar ist. Und die Review-Pflicht bleibt bestehen: Gerade gegen Ende langer Sessions entstehen Änderungen, die auf den ersten Blick plausibel aussehen und an den ursprünglichen Anforderungen vorbeigehen.