Ursprünglich auf Französisch verfasst. Von KI übersetzt — der Sinn wurde bewahrt, nicht der Stil.
Kurzdefinition
Erster Satz von Quellen, klein und sorgfältig ausgewählt, der eine iterative Recherche in Gang setzt, indem er einen ersten Wissenszustand herstellt.
Ausführliche Definition
Das Wort ist in mehreren Traditionen geläufig: Im maschinellen Lernen ist der Seed der Wert, der einen Zufallsgenerator initialisiert; in der Dokumentenrecherche nach dem Schneeballprinzip ist das Seed Set oder Start Set die Ausgangsmenge, deren Referenzen man folgt.
In den Artikeln dieses Blogs bezeichnet der Seed den Ausgangssatz einer Recherche, die über den Zustand des Korpus gesteuert wird. Er bestimmt sich über seine Funktion – sichtbar machen, was fehlt – und nicht über seine Abdeckung. Man erwartet von ihm, dass er verlässlich, vielfältig, nah am Kern des Themas und reichhaltig genug ist, damit eine erste konzeptuelle Struktur sichtbar wird.
Gebrauch im Feld
Verwendet bei der Rahmung einer Recherche in Schleifen – Vorbereitung einer Konferenz, Literaturübersicht, Auftrag an einen Recherche-Agenten –, in dem Moment, in dem man wählt, womit man beginnt.
Synonyme und Varianten
„Startkorpus“, „Ausgangssatz“, Start Set.
Nicht zu verwechseln mit
- Snowballing — Technik, die von einer Quelle ausgeht und ihren Referenzen und Zitierungen folgt. Auch sie startet mit einer Ausgangsmenge, aber dort entscheidet die Bibliografie über den weiteren Verlauf; hier die Diagnose des Korpus.
- repräsentative Stichprobe — Teilmenge, die die Proportionen einer Grundgesamtheit widerspiegelt. Der Seed will nicht repräsentativ sein, er will die Mängel sichtbar machen.
Beispiele
„Mit einem kleinen, aber gut kuratierten Seed starten“: ein paar Quellen, ausgewählt, um eine Recherche in Gang zu setzen, die mit 82 Quellen enden wird.
Mehrdeutigkeiten / Debatten
Die Grenze zwischen Seed und erster Iteration bleibt unscharf: Ein zu früh angereicherter Ausgangssatz wird zu klassischem Sammeln.