ArchiveBox: la tua Wayback Machine privata per salvare pagine, login e cronologia
ArchiveBox ti permette di archiviare pagine web, cronologia e sessioni autenticati, con supporto per PDF, screenshot, MHTML e molto altro. Scopri come funziona e quando è utile.

Non riesci più a recuperare le pagine web che hai salvato? Hai notato che alcune pagine spariscono, cambiano di frequente o non includono contenuti caricati dinamicamente? Il problema è che il tuo archivio non cattura tutto quello che il browser vede.
Cause più frequenti
- Il contenuto viene generato in JavaScript o tramite API dopo il caricamento della pagina.
- Le pagine richiedono autenticazione; i crawler tradizionali non vedono i dati protetti.
- Le risorse esterne (immagini, video, script) non sono incluse nel salvataggio.
- La cronologia del browser è esportata in formati incompleti o non sincronizzata con l’archivio.
- Il server web restituisce redirect o header HTTP che non vengono registrati.
Cosa provare
- Installa ArchiveBox sul tuo computer o su un server personale. Il progetto è open source e si può eseguire su Linux, macOS o Windows.
- Importa i bookmark e la cronologia dal tuo browser con l’estensione di ArchiveBox. Se usi Chrome o Firefox, l’estensione raccoglie automaticamente URL, screenshot e file MHTML.
- Configura una Persona: importa il profilo di un browser già autenticato (Chrome, Edge, Brave). In questo modo ArchiveBox può accedere a dashboard, portali e social network senza dover effettuare il login ogni volta.
- Avvia un “crawl” ricorrente: la nuova versione di ArchiveBox permette di schedulare scansioni settimanali o mensili, salvando HTML, PDF, screenshot e metadati in una collezione organizzata.
- Verifica i risultati nella Web UI: controlla che le pagine siano state salvate in più formati (PDF, MHTML, screenshot) e che le risorse siano presenti.
- Se la pagina è ancora incompleta, prova a disabilitare i plugin che ottimizzano il caricamento di JavaScript o a forzare il download di tutti i file esterni.
Quando fermarsi
Se dopo aver seguito tutti i passaggi sopra indicati le pagine rimangono incomplete, è probabile che il contenuto sia generato in modo estremamente dinamico o protetto da sistemi anti-scraping. In questi casi, la soluzione più semplice è utilizzare un servizio di backup a livello di rete o chiedere l’accesso diretto al proprietario del sito. Se invece il problema è solo la mancata sincronizzazione della cronologia, verifica che l’estensione sia aggiornata e che le impostazioni di privacy non blocchino la raccolta dei dati.
Domande frequenti
ArchiveBox è adatto per archiviare pagine con login?
Sì, grazie alle Personas ArchiveBox può importare i cookie di un browser già autenticato e accedere ai contenuti protetti.
Posso salvare anche PDF e screenshot contemporaneamente?
Assolutamente. Ogni URL può generare più artefatti: HTML, PDF, screenshot, MHTML e metadati.
Qual è il costo di ArchiveBox?
ArchiveBox è gratuito e open source; l’unico costo è quello del server dove lo ospiti.
Come integro ArchiveBox con altri software?
La piattaforma espone API REST e un plugin MCP; puoi scrivere script per automatizzare i backup o collegarlo a sistemi di CI/CD.
Dove posso trovare ulteriori guide?
Visita la sezione informatica per tutorial e consigli pratici.
