Scritto originalmente in francese. Tradotto dall'IA — il significato è stato preservato, non la prosa.
Definizione breve
Primo lotto di fonti, piccolo e scelto con cura, che avvia una ricerca iterativa producendo un primo stato di conoscenza.
Definizione dettagliata
La parola circola in più tradizioni: nel machine learning, il seed è il valore che inizializza un generatore casuale; nella ricerca documentale a palla di neve, il seed set o start set è l'insieme di partenza di cui si seguono i riferimenti.
Negli articoli di questo blog, il seed designa il lotto iniziale di una ricerca guidata dallo stato del corpus. Si definisce per la sua funzione — far emergere ciò che manca — e non per la sua copertura. Ci si aspetta che sia affidabile, diversificato, vicino al cuore del tema e abbastanza ricco da far comparire una prima struttura concettuale.
Uso nel dominio
Usato nell'inquadramento di una ricerca condotta per cicli — preparazione di una conferenza, rassegna della letteratura, incarico affidato a un agente di ricerca —, nel momento in cui si sceglie da dove cominciare.
Sinonimi e varianti
«corpus di avvio», «lotto iniziale», start set.
Da non confondere con
- Snowballing — tecnica che parte da una fonte e ne segue i riferimenti e le citazioni. Parte anch'essa da un insieme iniziale, ma è la bibliografia a decidere il seguito; qui è la diagnosi del corpus.
- campione rappresentativo — sottoinsieme che riflette le proporzioni di una popolazione. Il seed non cerca di essere rappresentativo, cerca di rendere visibili le mancanze.
Esempi
«Partire da un seed piccolo ma ben selezionato»: poche fonti scelte per avviare una ricerca che finirà con 82 fonti.
Ambiguità / dibattiti
Il confine tra seed e prima iterazione resta sfumato: un lotto iniziale arricchito troppo presto diventa una raccolta classica.