These

Ein endliches Aufmerksamkeitsfenster zwingt dazu, das Wissen aufzuteilen und in jeder Sitzung zu wählen, was hineinkommt

Info

Ursprünglich auf Französisch verfasst. Von KI übersetzt — der Sinn wurde bewahrt, nicht der Stil.

Blickwinkel

Ein Sprachmodell ruft schlecht ab, was man in der Mitte eines langen Dokuments vergraben hat, und dieses Nachlassen durch Befüllen ist eine gemessene Eigenschaft, kein Eindruck aus der Praxis: Die angegebene Kapazität eines Fensters und seine nutzbare Kapazität fallen nicht zusammen. Die gesamte Architektur eines Arbeitsraums mit einem Assistenten folgt aus dieser einen Einschränkung — ein kurzer Kern, der jedes Mal geladen wird, der Rest bei Bedarf abgerufen, getrennte Stufen für Quellen, Gedächtnis und Ergebnisse, kurze verknüpfte Notizen statt monolithischer Synthesen. Und diese Aufteilung, entworfen, um innerhalb einer technischen Grenze zu bleiben, hat drei Wirkungen, die mit dieser Grenze nichts mehr zu tun haben: Sie macht Schlussfolgerungen bis zu ihren Quellen zurückverfolgbar, sie erlaubt es, ein Deliverable jederzeit neu zu erzeugen statt erst am Ende einer Phase, und sie macht aus Themen, die zu nichts geführt haben, den Rohstoff der nächsten.

Zusammenfassung

Der Ausgangspunkt sieht nach einem Mengenproblem aus. Eine context.md-Datei wächst, bis sie nicht mehr handhabbar ist, und die naheliegende Antwort ist, sie zu zerschneiden. Der erste Schnitt erfolgt nach Empfänger — eine Datei für den Assistenten, eine für den Menschen —, weil die beiden Bedürfnisse wirklich unvereinbar sind: Der eine will Orientierungspunkte für die Wiederaufnahme, der andere will bündeln und abwägen. Dieser Schnitt hält nicht: Beide Dateien blähen sich ihrerseits auf und füllen sich jede mit ein bisschen von allem.

Was den Ausschlag gibt, ist nicht die Menge, sondern eine Eigenschaft des Modells. Das Fenster ist endlich, das ist bekannt, doch was darin steht, ist nicht gleichermaßen verfügbar — eine Information in der Mitte wird deutlich schlechter abgerufen als eine an den Rändern. Das Befüllen ist also nicht neutral: Jede hinzugefügte Zeile schiebt das, was schon da war, weiter in die Mitte, und nichts in der Antwort zeigt an, was übersehen wurde.

Daraus folgen unmittelbar zwei Regeln. Die erste betrifft das Laden: Ein kurzer Kern — Mission, aktueller Stand, Plan, Entscheidungen, offene Widersprüche — kommt jedes Mal hinein, und alles andere wartet darauf, abgerufen zu werden, in einer vorab festgelegten Reihenfolge statt einer, die man beim Öffnen der Sitzung improvisiert. Die zweite betrifft die Aufteilung: Sie richtet sich weder nach Menge noch nach Empfänger, sondern nach der Art des Inhalts — das Rohmaterial auf der einen Seite, das daraus Zurückbehaltene in der Mitte, die Ergebnisse am Ende. Was diese Architektur von einer bloßen Ablageordnung unterscheidet, ist, dass sie einen mechanischen Grund hat.

Und genau hier leistet dieser Aufbau mehr, als man von ihm verlangt hat. Die Stufen zu trennen, erlaubt es, eine Schlussfolgerung rückwärts zu durchlaufen — von der Zusammenfassung zum Checkpoint, vom Checkpoint zu den Sitzungen, von den Sitzungen zu den Quellen — und einem Stakeholder also etwas anderes zu antworten als „der Assistent hat es empfohlen“. Das Material aktuell zu halten, macht ein Deliverable günstig reproduzierbar, was der Abfolge Discovery–Specs–Auslieferung ihre wirtschaftliche Voraussetzung nimmt. Und weil es billig wird, ein Thema zu eröffnen, eröffnet man viele, von denen die meisten zu nichts führen — nur dass sie sich gegenseitig befruchten und ein viertes Thema reicher entsteht, dank dreier, die nirgendwohin geführt haben.

Die Granularität des Schreibens folgt derselben Einschränkung und bringt denselben Mehrwert. Kurze, verknüpfte Notizen lassen sich stückweise laden, und sie erlauben es auch, zwei Ideen nebeneinanderzulegen — was eine zehnseitige Synthese verhindert, da sich keine ihrer vierzig Ideen ohne die anderen neununddreißig zitieren lässt. Simulated Annealing, aus der Metallurgie auf die kombinatorische Optimierung übertragen, stammt nicht aus einem Wissensvorrat, sondern aus der Verbindung zweier präziser, weit auseinanderliegender Bereiche; die Granularität des Materials entscheidet, was einander begegnen kann.

Bleibt, was die Architektur nicht erfasst. Was den Wert eines Praktikers ausmacht, ist die Tiefe der Situation, die er verinnerlicht hat, und genau die fehlt einem Assistenten. Ein Teil davon lässt sich aufschreiben — das ist die Arbeit, einen Kontext aufzubauen, und das Aufschreiben stellt auf die Probe, was man verstanden zu haben glaubte, denn die Maschine nimmt beim Wort, was ein Kollege aufgefangen hätte. Ein anderer Teil lässt sich nicht aufschreiben: das spezifische Wissen, aus dem eine Überzeugung und eine Wette hervorgehen. Die Aufteilung verlagert viel Arbeit auf das, was man einer Maschine übergeben kann; im Umkehrschluss macht sie sichtbar, was sich nicht übergeben lässt.

Spannungen / Widersprüche

Eine Spannung betrifft die Auswahl selbst. Ein kurzer Kern macht den Assistenten einsatzfähig, und zugleich entscheidet er stillschweigend, was dieser nicht kennen wird: Was nicht geladen wurde, erzeugt keinen sichtbaren Fehler, genau wie das, was in der Mitte vergraben war. Die Aufteilung beseitigt also den Mangel nicht, den sie behandelt; sie verlagert seine Ursache von der Maschine auf denjenigen, der das Manifest verfasst hat.

Zweite Spannung, beim Vergessen. Ein Langzeitgedächtnis braucht eine Obergrenze, die seine Konsolidierung erzwingt, sonst wird es wieder zu einem Tagebuch, das niemand liest; doch gerade weil ein Dateisystem nichts vergisst, bleibt es möglich, eine Schlussfolgerung bis zu ihren Quellen zurückzuverfolgen. Was die Konsolidierung an Lesbarkeit gewinnt, nimmt sie der Beweiskette.

Dritte Spannung, bei der Granularität. Die Aufteilung in feine Einheiten ermöglicht Verbindungen zwischen weit entfernten Ideen, und sie erzeugt zugleich ein Netz, in dem eine logische Folgerung, ein Gegensatz und eine vage Verwandtschaft dieselbe Form annehmen. Nichts hier sagt, ab welcher Feinheit der Gewinn an Verbindungen in einen Verlust an Unterscheidungsvermögen umschlägt.

Fragen

  • Wie bemerkt man, dass ein außerhalb des Kerns gelassenes Element hätte hineingehört, wenn sein Fehlen keinen sichtbaren Fehler erzeugt?
  • Was in einer Gesamtheit offener Themen löst die Verbindung im richtigen Moment aus statt drei Monate zu spät?
  • Wie weit trägt diese Architektur, die für eine Person und ihren Assistenten entworfen wurde, wenn mehrere Personen im selben Arbeitsraum schreiben?