Tesi

Una finestra di attenzione finita impone di suddividere la conoscenza e di scegliere a ogni sessione che cosa vi entra

Info

Scritto originalmente in francese. Tradotto dall'IA — il significato è stato preservato, non la prosa.

Angolo

Un modello linguistico recupera male ciò che si è sepolto nel mezzo di un lungo documento, e questo degrado da riempimento è una proprietà misurata, non un'impressione d'uso: la capacità dichiarata di una finestra e la sua capacità utile non coincidono. Tutta l'architettura di uno spazio di lavoro con un assistente deriva da questo solo vincolo — un nucleo breve caricato sistematicamente, il resto richiamato su richiesta, livelli separati per le fonti, la memoria e ciò che si produce, note brevi collegate anziché sintesi monolitiche. E questa suddivisione, concepita per stare dentro un limite tecnico, produce tre effetti che con quel limite non hanno più nulla a che fare: rende le conclusioni ripercorribili fino alle loro fonti, permette di rigenerare un deliverable in qualsiasi momento anziché alla fine di una fase, e fa degli argomenti aperti senza sbocco la materia prima dei successivi.

Sintesi

Il punto di partenza sembra un problema di volume. Un file context.md cresce fino a non reggere più, e la risposta ovvia è tagliarlo. Il primo taglio si fa per destinatario — un file per l'assistente, uno per l'essere umano — perché i due bisogni sono davvero incompatibili: uno vuole punti di riferimento per riprendere, l'altro vuole aggregare e decidere. Questo taglio non regge: i due file si gonfiano a loro volta e si riempiono ciascuno di un po' di tutto.

Ciò che risolve la questione non è il volume, è una proprietà del modello. La finestra è finita, e questo si sa, ma ciò che vi si trova non è ugualmente disponibile — un'informazione collocata nel mezzo viene recuperata molto peggio di una collocata alle estremità. Riempire non è quindi neutro: ogni riga aggiunta spinge verso il centro ciò che c'era già, e niente nella risposta segnala che cosa è sfuggito.

Ne derivano direttamente due regole. La prima riguarda il caricamento: un nucleo breve — missione, stato attuale, piano, decisioni, contraddizioni aperte — entra sistematicamente, e tutto il resto aspetta di essere richiamato, secondo un ordine scritto in anticipo anziché improvvisato all'apertura della sessione. La seconda riguarda la suddivisione: non si fa né per volume né per destinatario ma per natura del contenuto, la materia grezza da una parte, ciò che se ne trattiene nel mezzo, ciò che si produce alla fine. Ciò che distingue questa architettura da un semplice riordino è che ha una ragione meccanica.

Ed è qui che il dispositivo rende più di quanto gli si chiedesse. Separare i livelli permette di percorrere una conclusione al contrario — dalla sintesi al checkpoint, dal checkpoint alle sessioni, dalle sessioni alle fonti — e quindi di rispondere a uno stakeholder qualcosa di diverso da «l'ha raccomandato l'assistente». Tenere aggiornato il materiale rende un deliverable riproducibile a basso costo, il che toglie alla sequenza discovery-specifiche-consegna la sua condizione economica. E poiché aprire un argomento diventa economico, se ne aprono molti, e la maggior parte non approda a nulla — salvo che si fertilizzano a vicenda, e un quarto argomento nasce più ricco da tre che non sono andati da nessuna parte.

La granularità della scrittura obbedisce allo stesso vincolo e produce lo stesso surplus. Note brevi e collegate si caricano a pezzi, e permettono anche di tenere due idee fianco a fianco — ciò che una sintesi di dieci pagine impedisce, dato che nessuna delle sue quaranta idee si cita senza le altre trentanove. La ricottura simulata, trasposta dalla metallurgia all'ottimizzazione combinatoria, non viene da un magazzino di sapere ma dal collegamento tra due ambiti precisi e distanti; la granularità del materiale decide che cosa può incontrarsi.

Resta ciò che l'architettura non cattura. Ciò che fa il valore di un professionista è la profondità della situazione che ha interiorizzato, ed è esattamente ciò che un assistente non ha. Una parte si scrive — è il lavoro di costruzione del contesto, e scriverla mette alla prova ciò che si credeva di aver capito, perché la macchina prende alla lettera ciò che un collega avrebbe corretto al volo. Un'altra parte non si scrive: il sapere specifico, quello che sfocia in una convinzione e in una scommessa. La suddivisione sposta molto lavoro verso ciò che si può affidare a una macchina; rende visibile, per differenza, ciò che non si lascia affidare.

Tensioni / contraddizioni

Una tensione riguarda la selezione stessa. Un nucleo breve è ciò che rende l'assistente operativo, ed è anche ciò che decide in silenzio che cosa ignorerà: ciò che non è stato caricato non produce alcun errore visibile, esattamente come ciò che era sepolto nel mezzo. La suddivisione non elimina quindi il difetto che tratta, ne sposta la causa dalla macchina a chi ha redatto il manifesto di caricamento.

Seconda tensione, sull'oblio. Una memoria lunga ha bisogno di un tetto che ne imponga il consolidamento, altrimenti torna a essere un diario che nessuno rilegge; ma è proprio perché un file system non dimentica nulla che resta possibile risalire da una conclusione fino alle sue fonti. Ciò che il consolidamento fa guadagnare in rileggibilità, lo toglie alla catena di prove.

Terza tensione, sulla granularità. La suddivisione in unità fini è ciò che permette i collegamenti lontani, ed è anche ciò che produce una rete in cui un'implicazione logica, un antagonismo e una vaga parentela assumono la stessa forma. Nulla qui dice a partire da quale finezza il guadagno in collegamenti si ribalti in perdita di discernimento.

Domande

  • Come accorgersi che un elemento lasciato fuori dal nucleo avrebbe dovuto entrarci, sapendo che la sua assenza non produce alcun errore visibile?
  • Che cosa, in un insieme di argomenti aperti, fa scattare il collegamento al momento giusto anziché tre mesi troppo tardi?
  • Fino a che punto questa architettura, concepita per una persona e il suo assistente, regge quando più persone scrivono nello stesso spazio di lavoro?