Word-Datei & Google Suche

  • Generell dazu: Ähnliche vermeintliche Problembeschreibungen wie "Google Bot spidert trotzdem alles" oder "Sperren in robots.txt funktioniert nicht" oder "meta noindex wird nicht beachtet" haben sich hier nach entspr. Analysen immer entweder als syntaktische oder logische Fehler in der robots.txt bzw. falsche oder auch doppelte widersprüchliche meta Angaben im Seiten head und/oder HTTP Headern erwiesen.

    • Anzeige

    Hallo!

    Wenn du gerade an deiner Website arbeitest oder dein aktuelles Hosting überdenkst: Wir betreiben mit NetzLiving eine Hosting-Plattform, die speziell auf Performance, Sicherheit und einfache Verwaltung ausgelegt ist.

    • ✔️ Schnelle Ladezeiten (optimiert für WordPress & Co.)
    • ✔️ Deutsche Server & DSGVO-konform
    • ✔️ Persönlicher Support (kein 0815-Ticket-System)

    Mehr erfahren

  • Analysen immer entweder als syntaktische oder logische Fehler in der robots.txt bzw. falsche oder auch doppelte widersprüchliche meta Angaben im Seiten head und/oder HTTP Headern erwiesen.

    Arbeitest du bei Google? Bei solcher Sicherheit deiner Meinung solltest du das wohl.
    Alle die wie nicht im Google Management arbeiten haben solche Einsicht nicht.
    So wie es aussieht haben auch die Google Manager keine sehr tiefe Einsicht in wie ihre Crawler funktionieren.

    Wie in https://developers.google.com/search/docs/ad…s-faq?hl=de#h17

    Zitat von Google

    Durch das Sperren einer Seite für das Crawlen durch Google wird die Seite wahrscheinlich aus dem Google-Index entfernt.
    Allerdings garantiert die Disallow-Anweisung in robots.txt nicht, dass eine Seite nicht in den Ergebnissen erscheint.


    Wahrscheinlich hat mit immer nicht zu tun.

  • Wahrscheinlich hat mit immer nicht zu tun.

    Die robots.txt hat auch nichts mit dem Ausschluss einer Seite aus dem Index zu tun. Sie dient nur zur Steuerung des Zugriffs der Suchmaschinen-Bots auf die Inhalte. Kannst oder willst Du das nicht verstehen?

    Wenn ich in der robots.txt Seiten oder Verzeichnisse ausschließe, dann werden sie vom Crawler nicht abgerufen. Daß sie wahrscheinlich aus dem Index entfernt werden, ist nur ein Nebeneffekt.

    Zitat aus der Google-Hilfe:

    Zitat

    Wenn deine Seite über eine robots.txt-Datei blockiert ist, kann sie zwar weiterhin in den Suchergebnissen erscheinen, aber das betreffende Suchergebnis enthält keine Beschreibung und sieht in etwa so aus. Bilddateien, Videodateien, PDFs und andere Nicht-HTML-Dateien werden ausgeschlossen.

    Für "Medien" ist es sogar so, daß diese durch die robots.txt auch tatsächlich aus dem Index ausgeschlossen werden.

    Gruß
    Ingo

    Wenn ich helfen konnte, bitte [ Gefällt mir ] klicken. :-)

    Einmal editiert, zuletzt von Putzlowitsch (10. März 2021 um 13:09)

Jetzt mitmachen!

Sie haben noch kein Benutzerkonto auf unserer Seite? Registrieren Sie sich kostenlos und nehmen Sie an unserer Community teil!