Ist es normal, dass jede Seite zusätzlich noch eine /feed Endung hat?

  • Auf meinem Blog http://www.allesroger.net hat seit einiger Zeit jede Seite/jederArtikel nicht nur die normale URL, sondern zusätzlich noch eine URL mit der Endung /feed. Nun habe ich ja bewusst die RSS-Feed Funktion aktiviert, aber ich ging immer davon aus, dass der Feed dann nur z.B. http://www.allesroger.net/feed lautet und nicht jede Unterseite ebenfalls nochmal eine solche URL erhält.

    Die Google Search Console mahnt das mittlerweile auch an. Ich hatte bereits alle Plugins deaktiviert, aber das Ergebnis hat sich nicht geändert.

    Daher die Frage: Ist das ein normales Verhalten in Wordpress? Kann und sollte ich etwas tun, um diese /feed URLs von den Crawlern zu verbergen, z.B. in der robots.txt?

    • Anzeige

    Hallo!

    Wenn du gerade an deiner Website arbeitest oder dein aktuelles Hosting überdenkst: Wir betreiben mit NetzLiving eine Hosting-Plattform, die speziell auf Performance, Sicherheit und einfache Verwaltung ausgelegt ist.

    • ✔️ Schnelle Ladezeiten (optimiert für WordPress & Co.)
    • ✔️ Deutsche Server & DSGVO-konform
    • ✔️ Persönlicher Support (kein 0815-Ticket-System)

    Mehr erfahren

  • Ist dein Umlaute Problem [size=14]f�... nicht wichtiger?[/SIZE]

    Absolut! Da bin ich gerade an der Recherche. Auch das ist neu und trat zuvor so noch nicht auf. Ich wollte dazu gerade die
    wp-config.php-Datei checken. Oder gibt es noch andere Tipps?

    Bezüglich der /feed-"Problematik" - muss ich mich sorgen, dass die Google Search Console diese URLs anmahnt?

  • wp-config.php-Datei checken. Oder gibt es noch andere Tipps?

    ich habe meine Systeme alle seit Jahren auf UTF-8. was da wo nicht auf UTF-8 läuft oder warum kann ich wirklich nicht sagen. Da bin ich raus. Ist einfach zu lange her.


    Bezüglich der /feed-"Problematik" - muss ich mich sorgen, dass die Google Search Console diese URLs anmahnt?

    kommt darauf an, wie Google Search Console auf die URLs mit feed reagiert. im Index haben diese URLs meiner Meinung nach nichts verloren.

    Mit offenen Augen träumen

  • Vermutlich durch Deine Cache Mechanismen serverseitig via Cloudflare und per WordPress Plugin W3 Total Cache geht der eigentlich von WordPress gesetzte HTTP Header[FONT=Courier New] x-robots-tag noindex, follow[/FONT] für die [FONT=Courier New]feed[/FONT] URLs bei Dir verloren. Deswegen erscheinen sie in Suchmaschinen und die Search Console nervt Dich damit. Behebe das.

  • Ich bin leider gerade etwas überfragt. Wo kann ich das denn ändern/anpassen? Auf Seiten Cloudflare finde ich dazu nichts. Ist das evtl. auf meinem eigenen Server? Wie komme ich denn an den HTTP Header? Und kann das alles evtl. auch mit meinem URF-8 Problem zusammenhängen?

    Ich musste nämlich jetzt auch noch feststellen, dass meine komplette Seite mit dem W3C Validator nicht mehr validiert werden kann: "
    Sorry, I am unable to validate this document because on line 1 it contained one or more bytes that I cannot interpret as utf-8 (in other words, the bytes found are not valid values in the specified Character Encoding). Please check both the content of the file and the character encoding indication.

    The error was: Modification of a read-only value attempted"

  • Ja, das ist richtig. Ich habe mein Blog auf Cloudflare "umgebogen". Wenn das nun Probleme verursacht, habe ich keine Ahnung, wo ich das auf Seiten Cloudflare fixen könnte...

  • Wie wäre es mit "zurückbiegen" ohne Cloudflare?

    Vielleicht behebt das auch das aktuelle "als UTF-8 markiert aber teils kein UTF-8 Inhalt" Problem.

    Oder Du testest erstmal, ob/was das Weglassen von W3 Total Cache in der Search Console bewirkt.

    Ergänzung: Was/wo genau wird in der Google Search Console bzgl. [FONT=Courier New]feed[/FONT] URLs gezeigt? Screenshot?

    2 Mal editiert, zuletzt von b3317133 (22. März 2023 um 16:16)

  • W3 Total Cache habe ich schon deaktiviert. Auch die meisten der anderen Plugins. Ich dachte, jetzt sei langsam alles in Ordnung und hatte deshalb alles wieder aktiviert.

    Das Ändern der Cloudflare Konfiguration geht nur über meinen Provider. Das habe ich gerade angestoßen.

    Die Google Search Console bricht wegen der feed URLs diverse Prüfungen ab:
    - Durch robots.txt-Datei blockiert (Das war mein Versuch, diese URLs zu verbergen)
    - Gecrawlt – zurzeit nicht indexiert (Dort macht es sogar einen Unterschied, ob die URLs die Endung /feed oder /feed/ haben. Beides taucht auf.)

  • Welche Google Search Console Prüfung wird wo wann abgebrochen?

    - Durch robots.txt-Datei blockiert (Das war mein Versuch, diese URLs zu verbergen)


    Die Meldung zeigt, dass Dein Versuch erfolgreich war.


    - Gecrawlt – zurzeit nicht indexiert (Dort macht es sogar einen Unterschied, ob die URLs die Endung /feed oder /feed/ haben. Beides taucht auf.)


    Alles bestens, soll auch nicht indexiert sein.

    Der o.g. extra [FONT=Courier New]noindex[/FONT] HTTP Header stammt hier auf dem Testserver aus einem Code Snippet, nicht aus WordPress selbst:

    Code
    add_action( 'template_redirect', function() {
        if ( is_feed() && headers_sent() === false ) {
            header( 'X-Robots-Tag: noindex, follow', true );
        }
    } );


    Evtl. hilft Dir das noch weiter.

  • Also ich bin mir nicht sicher. Aber wie es aussieht, wurde das UTF-8 Problem durch ein Widget in der Sidebar verursacht. Das Theme, alle Plugins und Cloudflare konnten ausgeschlossen werden.

    Das mit dem noindex HTTP header habe ich noch nicht ganz verstanden. Bzw. wo und wie sollte ich das einfügen?

  • Das mit dem noindex HTTP Header bräuchtest Du nur, wenn die Search Console Deine feed Links indexieren würde, was sie lt. Deinen zitierten Meldungen aber nicht tut. Also alles bestens.

  • Das mit dem noindex HTTP Header bräuchtest Du nur, wenn die Search Console Deine feed Links indexieren würde, was sie lt. Deinen zitierten Meldungen aber nicht tut. Also alles bestens.


    Okay, weil ich das in der robots.txt unterbunden habe: Disallow: */feed/ Aber ist das wirklich die beste Methode dafür? Und nur damit ich es verstehe und lerne: Wo müsste ich den von dir vorgeschlagenen Code einfügen? Ist das Teil .htacess?

  • Lt. dieser Meldung ist alles bestens, da wird auch kein robots.txt benötigt:

    - Gecrawlt – zurzeit nicht indexiert


    Das Code Snippet ist PHP Code für z.B. ein Child Theme oder ein eigenes Plugin. Sowas würde man nutzen können, um bereits indexierte feed URLs wieder aus den Suchergebnissen zu bekommen, bei Dir sind die aber lt. Deiner Meldung gar nicht indexiert.

    Es bleibt am Ende unklar, was hier jetzt eigentlich das feed Problem ist oder war, evtl. wurden einfach nur Hinweise in der Google Search Console missverstanden bzw. hier "Search Console mahnt das mittlerweile auch an" und "Google Search Console bricht wegen der feed URLs diverse Prüfungen ab" missverständlich kommuniziert.

  • Es bleibt am Ende unklar, was hier jetzt eigentlich das feed Problem ist oder war, evtl. wurden einfach nur Hinweise in der Google Search Console missverstanden bzw. hier "Search Console mahnt das mittlerweile auch an" und "Google Search Console bricht wegen der feed URLs diverse Prüfungen ab" missverständlich kommuniziert.


    Ja, das mag sein, dass ich das vielleicht überinterpretiert habe. Für mich war es ein Warnsignal, wenn eine Validierung in der Google Search Console mit "Fehlgeschlagen" beendet wird.

    Und nicht falsch verstehen, dass die /feed URLs nicht indexiert wurden, liegt meines Erachtens daran, dass ich die robots.txt angepasst habe. Ich bin mir nur nicht sicher, ob das der richtige Weg dafür ist.

  • Und nicht falsch verstehen, dass die /feed URLs nicht indexiert wurden, liegt meines Erachtens daran, dass ich die robots.txt angepasst habe.

    nö eigentlich nicht.

    Wenn etwas wegen der robots.txt ausgesperrt wird, bekommst du dies auch über die von dir bevorzugte Google Search Console angezeigt. Da du keinerlei Informationen darüber zeigst - kann ich dir nur aus meiner Erfahrung bestätigen, die robots.txt spielt dabei überhaupt keine Rolle.

    Und wenn du feeds anbietest, solltest du die nachteiligen Seoeigenschaften kennen
    https://de.ryte.com/wiki/RSS-Feed

    Mit offenen Augen träumen

Jetzt mitmachen!

Sie haben noch kein Benutzerkonto auf unserer Seite? Registrieren Sie sich kostenlos und nehmen Sie an unserer Community teil!