Task / Tâche #4624
closedArchivierung von Alten Seiten
0%
Description
wget -m -k -p -E -e robots=off http://example.com/
Lädt rekursiv eine Kopie (-m 1)) der Webseite herunter, wandelt alle Links in relative Pfade um (-k), lädt auch alle evtl. von extern eingebetteten Dinge mit herunter (-p), ignoriert die robots.txt Datei (-e robots=off) und hängt bei Dateien die nicht auf htm(l) enden eine entsprechende Endung an (-E).
Sollte vor dem Serverumzug stattfinden
AD Updated by admin over 13 years ago
- Due date set to 18 April 2013
Automatically enforce due date for Low Priority after 60 days in the future
AD Updated by admin over 13 years ago
- Assignee set to Apophis
Assign unassigined ticket to project leader
CO Updated by corvus over 13 years ago
Wie sieht es bei Seiten welche mit get parametern arbeiten aus?
Beispiel: http://parrot.fm/?feed=podcast
Dies scheint nach der Archivierung mit wget nicht zu funktionieren, respektive der Webserver liefert die index datei aus.
AP Updated by Apophis over 13 years ago
ich werde Simon mal anfragen
AP Updated by Apophis over 13 years ago
- Status changed from New to Needs Work
AP Updated by Apophis over 13 years ago
- Assignee changed from Apophis to odi
Leiter ad interim
AP Updated by Apophis over 13 years ago
- Assignee changed from odi to oschad
Leiter ad interim
OS Updated by oschad over 13 years ago
- Status changed from Needs Work to k_backlog
- Assignee deleted (
oschad)