Cattura (Record)
aka harvesting, crawling, …
Software dedicati, che impersonano l'attività di una persona che naviga il sito
con un browser e salvano il contenuto man mano che lo navigano.
Alcuni sono automatici (crawler, browser headless), in altri la navigazione
avviene manualmente: dipende dalla natura tecnica del sito da archiviare.
Siti difficili da catturare: contenuti caricati via JavaScript, scroll infinito,
login e paywall, video in streaming, piattaforme social chiuse.