Termine

Seed

Info

Scritto originalmente in francese. Tradotto dall'IA — il significato è stato preservato, non la prosa.

Definizione breve

Primo lotto di fonti, piccolo e scelto con cura, che avvia una ricerca iterativa producendo un primo stato di conoscenza.

Definizione dettagliata

La parola circola in più tradizioni: nel machine learning, il seed è il valore che inizializza un generatore casuale; nella ricerca documentale a palla di neve, il seed set o start set è l'insieme di partenza di cui si seguono i riferimenti.

Negli articoli di questo blog, il seed designa il lotto iniziale di una ricerca guidata dallo stato del corpus. Si definisce per la sua funzione — far emergere ciò che manca — e non per la sua copertura. Ci si aspetta che sia affidabile, diversificato, vicino al cuore del tema e abbastanza ricco da far comparire una prima struttura concettuale.

Uso nel dominio

Usato nell'inquadramento di una ricerca condotta per cicli — preparazione di una conferenza, rassegna della letteratura, incarico affidato a un agente di ricerca —, nel momento in cui si sceglie da dove cominciare.

Sinonimi e varianti

«corpus di avvio», «lotto iniziale», start set.

Da non confondere con

  • Snowballing — tecnica che parte da una fonte e ne segue i riferimenti e le citazioni. Parte anch'essa da un insieme iniziale, ma è la bibliografia a decidere il seguito; qui è la diagnosi del corpus.
  • campione rappresentativo — sottoinsieme che riflette le proporzioni di una popolazione. Il seed non cerca di essere rappresentativo, cerca di rendere visibili le mancanze.

Esempi

«Partire da un seed piccolo ma ben selezionato»: poche fonti scelte per avviare una ricerca che finirà con 82 fonti.

Ambiguità / dibattiti

Il confine tra seed e prima iterazione resta sfumato: un lotto iniziale arricchito troppo presto diventa una raccolta classica.