Idee

Ein Deep-Research-Agent ohne Zustand seines Wissens kann seine nächste Suche nicht wählen

Info

Ursprünglich auf Französisch verfasst. Von KI übersetzt — der Sinn wurde bewahrt, nicht der Stil.

Hauptgedanke

Viele Deep-Research-Systeme folgen einer Architektur „suchen → extrahieren → zusammenfassen → schreiben“. Selbst wenn sie mehrere Suchen starten, bleiben diese Zweige eines Plans, der sehr früh festgelegt wurde. Die Recherche ist dort eine Phase, die der Generierung vorausgeht.

Eine wirklich adaptive Schleife verlangt, dass der Agent einen Zustand pflegt: den Scope, das stabilisierte Wissen, seine Herkunft und den Grad seiner Absicherung, die Widersprüche, die Unsicherheiten, die erkannten Lücken, die bereits durchgeführten Suchen, die Strategien, die nichts gebracht haben, die Bereiche, die als gesättigt gelten. Erst dieser Zustand erlaubt ihm, bei jedem Schritt die einzige nützliche Frage zu beantworten: Welche Suche maximiert jetzt die Chance auf einen Wissensgewinn?

Tiefe ersetzt diesen Zustand nicht. Ein Agent kann hundert Dokumente lesen und dabei dieselben Verzerrungen wiederholen, enorm viel erkunden, ohne je die Quelle zu suchen, die seinem zentralen Schluss widerspricht, einen riesigen Kontext anhäufen, ohne zu wissen, was unsicher bleibt.

Warum das wichtig ist

Es verschiebt das Kriterium, nach dem man ein KI-Recherchewerkzeug bewertet: nicht, wie viele Quellen es liest, sondern was es darüber weiß, was es verstanden hat und was ihm fehlt.

Und es sagt, was man zusätzlich zu einer Recherche-Pipeline bauen muss: ein Gedächtnis des Wissenszustands, das bei jeder Iteration aktualisiert und vor der nächsten wieder gelesen wird.

Nuancen und Grenzen

Diesen Zustand zu pflegen kostet, in Tokens wie im Design, und bei einer einfachen Frage reicht eine lineare Recherche.

Und ein schlecht gepflegter Zustand – nicht aktualisierte Unsicherheiten, zu Unrecht als gesättigt erklärte Bereiche – führt den Agenten zu Entscheidungen, die selbstsicherer sind, aber nicht richtiger.

Offene Fragen

  • In welcher Form bleibt dieser Zustand für einen Menschen lesbar, der die Entscheidungen des Agenten kontrollieren will?