Ursprünglich auf Französisch verfasst. Von KI übersetzt — der Sinn wurde bewahrt, nicht der Stil.
Blickwinkel
Einem Entwicklungsassistenten ein Gedächtnis zu geben heißt nicht, einen Ort zum Schreiben auszusuchen, sondern fünf Entscheidungen zu verteilen: wo das Gedächtnis liegt, was darin behalten wird, wann es verdichtet wird, in welchem Takt es geschrieben wird und wann es wieder gelesen wird. Vier davon lassen sich ohne Verlust automatisieren; die fünfte, das Neuladen, muss eine menschliche Handlung bleiben, weil nur sie die knappe Ressource einer Sitzung verbraucht. Ein Gedächtnis scheitert an dieser Verteilung, lange bevor es an seinem Format scheitert: Eine schlecht verteilte Markdown-Datei ist nicht besser als eine Datenbank, und eine richtige Verteilung funktioniert mit beiden.
Zusammenfassung
Das Ausgangsproblem sieht nach einem Speicherproblem aus. Claude Code vergisst zwischen zwei Sitzungen alles, also muss irgendwo aufgeschrieben werden, was es wissen sollte. Die Frage scheint erledigt, sobald das Format entschieden ist: Markdown-Dateien im Git-Repo statt eines versteckten Verzeichnisses auf der Maschine.
Damit ist in Wahrheit nur eine der Entscheidungen getroffen, und zwar die einzige, die sich vollständig rückgängig machen lässt. Die vier anderen stellen sich danach, und jede entscheidet zwischen Mensch und Maschine.
Was behalten wird, bestimmt niemand mehr von Hand. Ein leichtes Modell liest jeden Austausch und entscheidet allein, was ins Tages-Log kommt und was ins Langzeitgedächtnis aufsteigt. Die Entscheidung ist nicht verschwunden: Sie ist vom Handgriff in den Text gewandert – ein Prompt, vorgegebene Abschnitte, eine Anweisung zur Deduplizierung. Diese Verlagerung ist der strittigste Punkt der ganzen Anordnung, denn sie widerspricht einer anderswo besser begründeten Position, nach der den Wert einer Persistenz gerade ausmacht, dass ein Mensch gesagt hat: „Das zählt.“ Beides hält, aber nicht für dieselbe Menge: Zwanzig Austausche am Tag bestimmt niemand von Hand.
Wann verdichtet wird, bleibt ebenso wenig dem guten Willen überlassen. Eine Obergrenze von dreihundert Zeilen für long_memory.md löst die Konsolidierung aus, und es ist die Größenbeschränkung – willkürlich und bewusst so gewählt –, die den Anlass zum Wiederlesen schafft. Ohne sie bleibt die Pflege eine Absicht.
In welchem Takt geschrieben wird, gibt das gewählte Hook-Ereignis vor, und genau dort beginnt der Fehler. Ein Hook namens Stop lässt an das Ende einer Sitzung denken; ausgelöst wird er nach jedem Gesprächszug. Diese Frequenz entscheidet dann über alles, was tragbar ist: das gewählte Modell, die vertretbare Dauer, das Budget pro Ausführung. Eine vernachlässigbare Schwelle – weniger als ein Dollar im Monat – erkauft keine Ersparnis, sondern das Verschwinden einer Frage, und eine Automatisierung, über die man bei jedem Austausch diskutiert, wird am Ende abgeschaltet.
Wann wieder gelesen wird, ist die einzige Entscheidung, die nicht abgegeben wurde. Schreiben kostet niemanden etwas; Laden belegt das Fenster einer Sitzung, und wer das Gedächtnis eines Projekts ungefragt in eine Sitzung einspielt, die für drei Zeilen geöffnet wurde, verschlechtert die Antwort. Daher /memory_load von Hand – was wie eine Einschränkung aussieht und eine Abwägung ist.
Bleiben die Pannen, die diesem Aufbau eigen sind, und auch sie kommen nicht vom Format. Ein Automat, der das Werkzeug aufruft, dessen Ende er überwacht, weckt sich selbst. Ein Hilfsagent, der aus dem Projektverzeichnis gestartet wird, erbt die Schreibregeln dieses Projekts und liefert nicht mehr die Struktur, die man von ihm verlangt. Zwei Entwurfsfehler, zwei Entscheidungen, die schlecht verteilt sind zwischen dem, was der Automat tut, und dem, was er erkennen muss.
Was das Ganze sichtbar macht: Ein Gedächtnissystem beurteilt man nicht danach, was es aufbewahrt, sondern danach, wo jede Entscheidung angesiedelt wurde – und alles lässt sich verlagern, nur die letzte nicht.
Spannungen / Widersprüche
Der Hauptwiderspruch betrifft die Frage, wer bestimmt, was überlebt. Eine anderswo begründete Position besagt, dass der Wert einer Persistenz in der Handlung liegt, mit der ein Mensch sagt: „Das zählt“, und dass eine vollständige Aufbewahrung nichts bestimmt; dieses System delegiert die Auswahl an ein Modell, nach einem einmal formulierten Kriterium. Die Trennlinie ist nicht gezogen: Sie scheint von der Menge und von der Toleranz gegenüber stillem Verlust abzuhängen, aber nichts hier sagt, wo genau sie verläuft.
Eine zweite, weniger sichtbare Spannung: Das Gedächtnis wird ins Repo geschrieben, damit es überprüfbar und von Hand korrigierbar ist, und es entsteht in einem Takt, der dieses Wiederlesen unwahrscheinlich macht. Die Überprüfbarkeit ist als Eigenschaft real, als Praxis ungewiss.
Fragen
- Wie lässt sich eine solche Verteilung auf ein Team übertragen, in dem das Gedächtnis, das der eine schreibt, zum Kontext wird, den der andere lädt?
- An welchem Signal ließe sich erkennen, dass ein delegiertes Auswahlkriterium begonnen hat, das auszusortieren, was zählte?