Ursprünglich auf Französisch verfasst. Von KI übersetzt — der Sinn wurde bewahrt, nicht der Stil.
Hauptgedanke
Man kann einen Assistenten wie Claude Code auf zwei Arten um dasselbe bitten: Er sortiert die Dateien eines Verzeichnisses direkt in seinem Kontext, oder er schreibt das Python-Skript, das sie sortiert. Das sichtbare Ergebnis ist dasselbe – die Dateien sind sortiert. Was danach übrig bleibt, ist es nicht.
Im ersten Fall existiert die Operation nirgends: Man kann sie nicht nachlesen, nicht nachvollziehen, was mit der fünfzigsten Datei geschehen ist, und sie im nächsten Monat nicht wiederholen, ohne erneut zu fragen. Im zweiten Fall liefert der Assistent ein Objekt, das sich prüfen lässt – die Sortierregel steht schriftlich da, sie ist in zwei Minuten gelesen, man kann sie korrigieren, auf andere Dateien anwenden, und sie liefert bei jedem Lauf dasselbe Ergebnis.
Verschoben hat sich, was man delegiert. Man delegiert nicht mehr die Ausführung, sondern das Schreiben der Regel, nach der ausgeführt wird – und diese Regel, nicht ihr Ergebnis, ist es, die man prüfen muss.
Warum das wichtig ist
Daraus ergibt sich ein Kriterium für die Form einer Delegation, noch bevor man Modell oder Prompt wählt: Sobald eine Operation sich wiederholen soll, eine Menge betrifft, die man nicht durchlesen wird, oder später begründet werden muss, ist das richtige Ergebnis das Skript, nicht das Resultat.
Es erklärt auch, warum sich diese Art der Delegation so bequem anfühlte: Der Umfang war begrenzt, die Ausgabe kurz, und die Prüfung beschränkte sich darauf, eine Funktion zu lesen. Der Schritt zu einem vollständigen Produkt – Oberflächen, interne APIs, Datenänderungen – lässt diese Eigenschaft wegfallen, ohne dass irgendetwas den Wechsel ankündigt.
Nuancen und Grenzen
Die Regel gilt nur für deterministische Operationen. Eine Sortierung nach Dateiendung lässt sich als Skript schreiben; eine Einordnung, die verlangt, den Inhalt jeder Datei zu beurteilen, nicht – wer sie trotzdem in ein Skript zwingt, schreibt ein schlechtes Kriterium fest.
Und das Skript verlagert die Prüfung, ohne sie abzuschaffen: Ein Skript, das an der Stichprobe richtig arbeitet, kann sich beim Rest irren, genau wie die direkte Ausführung.
Offene Fragen
- Ab welcher Menge an generiertem Code lässt sich die Ausgabe nicht mehr prüfen, und was muss man dann statt des Skripts erzeugen, um dieselbe Prüfbarkeit zu behalten?