Scaricare interi siti web da Wayback Archive.org

Categoria:
Utilità PC Windows
Commenti: 0

Per anni, recuperare un sito web sopravvissuto solo dentro l’Internet Archive è stato un lavoro faticoso, pagina per pagina. Ora le cose cambiano. Una nuova estensione per Chrome, Wayback Site Downloader, trasforma web.archive.org in uno strumento di recupero siti con un solo clic: scansiona un intero dominio archiviato e salva ogni pagina e file ricostruendo fedelmente la struttura di cartelle originale.

La promessa è semplice: incolli un URL della Wayback Machine (o anche solo un dominio), scansioni l’archivio e scarichi l’intero sito così com’era in una data precisa. Nessuna versione più recente, nessuna toolbar iniettata, nessuna copia manuale.

👉 Installa WayBack Site Downloader dal Chrome Web Store   ——–   Guarda il video tutorial

Scegli un momento nel tempo

La funzione di punta è la precisione dello snapshot. Incolla un qualsiasi URL della Wayback Machine che includa una data e lo strumento scarica la versione di ogni file più vicina a quella data, mai una più recente. Preferisci l’ultima copia disponibile? Basta inserire il dominio nudo e crudo e viene recuperata la versione più recente dell’intero sito.

Scansiona tutto l’archivio con un clic

Invece di navigare pagina per pagina, Wayback Site Downloader interroga direttamente le API CDX ufficiali di archive.org. Un solo clic mette in coda ogni pagina, immagine, foglio di stile e file unico — un processo che, secondo lo sviluppatore, resta veloce anche su siti con migliaia di pagine. Dietro le quinte, inoltre:

  • Deduplica le varianti http/https/www e le porte della stessa pagina in un unico file.
  • Ignora i parametri di tracciamento (utm_, fbclid, gclid e un elenco personalizzabile) per evitare pagine duplicate.
  • Salva facoltativamente i sottodomini come forum.sito.com o shop.sito.com in cartelle dedicate.
  • Offre una modalità fast-scan per siti enormi, scansione paginata e tentativi automatici quando archive.org restituisce errori del server.

Struttura delle cartelle originale, ricostruita

Tutto viene scaricato in Downloads/nomesito_data/ con le cartelle e le sottocartelle originali del sito fedelmente ricostruite, pronte da consultare offline. E, aspetto fondamentale, i file vengono salvati puliti, senza la toolbar della Wayback Machine che normalmente viene iniettata nelle pagine archiviate.

Un motore di download pensato per i lavori grossi

Lo strumento lavora in due fasi — Scansione, che analizza l’archivio e costruisce la coda, e Download, un motore robusto con filtri granulari e controlli di recupero. L’utente può:

  • Escludere estensioni specifiche (exe, zip, iso…) oppure scaricare solo i tipi che servono (html, jpg, pdf…).
  • Limitare per dimensione del file, numero di file o stato HTTP (solo 200) ed escludere gli URL con querystring.
  • Impostare da 1 a 8 download simultanei, con un ritardo anti-blocco tra un file e l’altro.
  • Mettere in pausa, riprendere e annullare in qualsiasi momento, e riprovare i file falliti con un clic.
  • Contare su un backoff automatico di 30 secondi quando scattano i limiti di frequenza di archive.org.

Contatori in tempo reale tengono traccia dei file completati, in coda, attivi e falliti. L’intera interfaccia vive nel pannello laterale di Chrome, così resta visibile mentre navighi, ed è disponibile in 8 lingue tra cui inglese, italiano, spagnolo, francese, tedesco, portoghese e cinese.

A chi serve?

L’estensione è pensata per chiunque abbia bisogno di un sito che esiste solo — o esiste solo in una versione precisa — dentro l’Internet Archive:

  • Proprietari di siti che recuperano un vecchio sito dopo la perdita dell’hosting, un dominio scaduto o una migrazione fallita.
  • Ricercatori e giornalisti che conservano pagine archiviate e studiano come i siti sono cambiati nel tempo.
  • Web designer che recuperano vecchi layout, grafiche e contenuti come riferimento per i redesign.
  • Archivisti digitali che creano copie offline di siti storici prima che spariscano.

Versione gratuita e sblocco PRO

La versione gratuita scansiona qualsiasi sito e scarica fino a 150 file per progetto — sufficienti per siti piccoli e per fare prove. Lo sblocco PRO rimuove ogni limite ed è pensato per il lavoro di recupero completo: siti con centinaia o migliaia di pagine e progetti ricorrenti di archiviazione o ricerca.

L’attivazione è indolore. Quando si raggiunge il limite gratuito il download si mette semplicemente in pausa; inserisci il codice di sblocco nel pannello laterale, premi Riprendi e vengono completati i file rimanenti.

Come si usa

  1. Installa l’estensione dal Chrome Web Store e clicca sulla sua icona per aprire il pannello laterale.
  2. Incolla un URL della Wayback Machine con la data dello snapshot, oppure digita solo il dominio per la versione più recente.
  3. Clicca su Scansiona sito: l’archivio viene analizzato e tutti i file unici vengono messi in coda.
  4. Regola i filtri: estensioni escluse, tipi di file, limiti di dimensione, sottodomini e altro.
  5. Clicca su Avvia download e trovi l’intero sito in Downloads/nomesito_data/ con le sue cartelle originali.

👉 Installa dal Chrome Web Store   ——–   Guarda il video tutorial

In conclusione

Scaricare un intero sito archiviato voleva dire pazienza, script o fortuna. Con Wayback Site Downloader diventa un lavoro in due passi dentro un pannello laterale del browser — scansiona, poi scarica. Se ti è mai capitato di dover riportare in vita un sito dal passato, ora è davvero possibile con un solo clic.

 

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *