Webroot verloren

  • Hi,

    in den letzten Tagen mussten wir das Blog auf linuxnews.de aus einem DB Dump wiederaufbauen, da die Webroot verloren bzw. bestens passwortgeschützt ist und das Passwort nicht im PW-Manager gespeichert wurde. Die Artikel sind alle da, Bilder sind alle weg. Ich habe viele davon noch lokal vorliegen, zudem sind die ja auf archive.org vorhanden.

    Deshalb frage ich mich: Gibt es eine Möglichkeit, die Bilder von archive.org zu scrapen und den Artikeln im Blog automatisch zuzuordnen? Mir graut nämlich vor der Aufgabe, über 2.000 Bilder händisch wieder einzufügen.

    ein schönes Wochenende wünscht:
    Ferdinand

    • Anzeige

    Hallo!

    Wenn du gerade an deiner Website arbeitest oder dein aktuelles Hosting überdenkst: Wir betreiben mit NetzLiving eine Hosting-Plattform, die speziell auf Performance, Sicherheit und einfache Verwaltung ausgelegt ist.

    • ✔️ Schnelle Ladezeiten (optimiert für WordPress & Co.)
    • ✔️ Deutsche Server & DSGVO-konform
    • ✔️ Persönlicher Support (kein 0815-Ticket-System)

    Mehr erfahren

  • Also mit etwas Linux-Wissen sollte zumindest das scrapen per wget oder curl eigentlich machbar sein. Wenn in der Datenbank noch die Verweise auf die Bild-Dateinamen vorhanden sind, müsstest Du die Dateien dann eigentlich "nur" noch im wp-contents/uploads/ an entsprechender Stelle (wo sie vorher auch waren) ablegen. Versuch das doch mit 1-2 Bildern erstmal. Runterladen, im bisherigen Pfad ablegen und schauen, ob Wordpress sie dann in der Webseite anzeigt.

  • Ich benutze zum Download von Seiten oft https://www.httrack.com/

    Da archive.org die gleiche dateistruktur verwendet sollte es eigentlich copy und paste sein.

    Ich persönlich empfehle euch künftig Backups von der Seite auf einem host aufzubewahren :-)

    Digitaler Rucksack Nomade


  • in den letzten Tagen mussten wir das Blog auf linuxnews.de aus einem DB Dump wiederaufbauen, da die Webroot verloren bzw. bestens passwortgeschützt ist

    https://linuxnews.de/2022/02/in-eig…geht-es-weiter/

    Mein Provider bietet bei meinen Servern einen Backup Server an. Somit ein Tipp, evtl. hat der Provider ein Backup?


    Gibt es eine Möglichkeit, die Bilder von archive.org zu scrapen

    Es gibt "grabber" klassen und funktionen für PHP

    https://hotexamples.com/examples/-/-/g…n-examples.html


    und den Artikeln im Blog automatisch zuzuordnen?

    Bilder hüst ... bei WordPress .. automatisch Artikeln zuzuordnen... nein. Wir haben hier eine KI die dies bei Online Shops macht. Hier sind wir froh, dass die KI die Teekanne als Teekanne erkennt und nicht als rotes Hochzeitskleid... oder so...

    tipp, eben selber hacken
    https://lippke.li/hacking-tools/

    Mit offenen Augen träumen

    Einmal editiert, zuletzt von r23 (19. Februar 2022 um 15:11)

  • Danke für euren Input. Ich lade gerade das gesamte Blog von archive.org herunter und werde dann die Bilder sukzessiv per Hand in die alten Artikel einfügen.

  • Bei dem Dienst hinter dem zweiten Link hatte ich angefragt. Die hätten die Seite passend für WordPress für ~ $600 bereitgestellt. (~ 2.000 Beiträge). Ansonsten läuft der Download, ist halt langsam, vermutlich ~ 36 h.

Jetzt mitmachen!

Sie haben noch kein Benutzerkonto auf unserer Seite? Registrieren Sie sich kostenlos und nehmen Sie an unserer Community teil!