- Ein Multi-Page-Application-(MPA)-Archiver, der mehrseitige Web-Apps in eine ZIP-Datei crawlt und direkt daraus ausliefern kann
- Mit
mpa http://example.netwird mithilfe von headless Puppeteer rekursiv gecrawlt (verwendetAnzahl der CPUs / 2Threads) - Holt die Sitemap und verwendet sie als Seed-Punkte
- Crawlt nur Website-URLs,
fetcht aber auch externe Ressourcen - Speichert die Ressourcen der Website doppelt
- Erstellt
mpa/sitemap.txtundmpa/sitemap.xml - Kann nach einer Unterbrechung fortgesetzt werden. Speichert alle 250 URLs einen Checkpoint
- Bei SPAs kann mit der Option
--spadas ursprüngliche HTML gespeichert werden
Noch keine Kommentare.