die Standardeinstellung von httrack ist, daß das Programm den „Anweisungen“ der Datei „robots.txt“ folgt. diese Option kannst Du deaktivieren, Ist aber nicht unbedingt ein netter Akt. Vielleicht wollen die Herrschaften nicht, daß Du ihre Website kopierst?
Die Herrschaften wollen aber, dass ich diese Homepage kopiere, da ich für dieses Unternehmen arbeite und wir eine neue Website erstellen. Die alte soll sozusagen archiviert werden, aber konnte bisher keine anderen Ideen finden…
Was hat es mit der Datei „robots.txt.“ auf sich und wie kann ich diese Anweisung deaktivieren?
Die Herrschaften wollen aber, dass ich diese Homepage kopiere,
da ich für dieses Unternehmen arbeite und wir eine neue
Website erstellen. Die alte soll sozusagen archiviert werden,
aber konnte bisher keine anderen Ideen finden…
Oha! Sorry, jetzt wird es hart - wenn du weich beseitet bist, unten weiter lesen: Ich kann mir nicht vorstellen, dass eine so grosse Firma einen solchen Auftrag an einen Mitarbeiter vergibt, der nicht mit der Materie vertraut ist und alle Infos, den angenommen Auftrag durchführen zu können, in Internet-Foren „zusammenfragt“.
Was hat es mit der Datei „robots.txt.“ auf sich und wie kann
ich diese Anweisung deaktivieren?
Möglichkeit 1: Dokumenttion von Httrack lesen.
Möglichkeit 2: Google benutzen
Möglichkeit 3: Den Umsetzer/Betreiber euerer Webseite kontaktieren.
Ich wette mit dir, dass nur Möglichkeit 3 zum Ziel führt, denn das sind nicht einfach „Webseiten“ auf der Domain. Dort läuft ein Content Management System. Das zu archivieren ist in der Regel recht einfach, da es anscheinend auf PHP basiert: Alle Skripte vom Server sichern, Konfigurationen sichern, Datenbankdump erstellen und sichern, ggf. die komplette Systemumgebung sichern um sicher zu stellen, dass es jederzeit lauffähig gemacht werden kann.