• Hi, ich habe festgestellt, dass Google nur meine Index Seite crawlt. Ich weis nicht woran das liegt. Ich war vor einigen Monaten auf einem anderen Server, da hatte ich aber keine sitemap und auch keine robots.txt, trotdem wurde die Seite stündlich gecrawlt, und zwar wirklich jeder Beitrag und Seite.

    Seid dem Umzug sind einige Plugins dazugekommen, aber die Theme ist die Selbe geblieben. Ich weiß nicht ob Google die anderen Beiträge und Pages einfach nicht findet, oder garnicht danach suchen will. Auf jeden Fall waren einige Tage nach dem Umzug etwa 200 Einträge in Google gelistet. Jetzt (knapp 2 Monate später) sind es nur noch 80, obwohl ständig Inhalt dazugekommen ist. Jetzt habe ich mal die sitemap gelöscht, um zu sehen was passiert.

    Es wird übrigens das Plugin Googlebot benutzt um das crawling Verhalten zu beobachten.

    Ich muss noch dazu sagen, dass ich nach dem Umzug meine Sitemap und robots.txt 3-4 mal abgeändert habe. Könnte es vielleicht sein, dass Google sowas nicht mag?

    • Anzeige

    Hallo!

    Wenn du gerade an deiner Website arbeitest oder dein aktuelles Hosting überdenkst: Wir betreiben mit NetzLiving eine Hosting-Plattform, die speziell auf Performance, Sicherheit und einfache Verwaltung ausgelegt ist.

    • ✔️ Schnelle Ladezeiten (optimiert für WordPress & Co.)
    • ✔️ Deutsche Server & DSGVO-konform
    • ✔️ Persönlicher Support (kein 0815-Ticket-System)

    Mehr erfahren

  • Also ohne deine Seite zu sehen, fielen mir folgende Dinge ein:

    - noindex,nofollow gesetzt (vllt ein SEO-Plugin installiert?)
    - rel="nofollow" bei den Links angegeben?
    - die robots.txt könnte fehlerhafte Angaben enthalten, vllt mal zeigen

    wpseek.com - Die WordPress-Code-Suchmaschine

  • Meine robots.txt sieht so aus, die habe ich auch irgendwo herauskopiert, denke, dass sie auf den ersten Blick auch auf meine Seite anwendbar ist. Was mir grade auffällt, ich habe kein /cgi-bin..

    Ich habe ein SEO Plugin installiert, aber nichts daran konfiguriert.

    Das verstehe ich nicht:
    - noindex,nofollow gesetzt
    - rel="nofollow" bei den Links angegeben?

    EDIT: Hab mir die Konfiguration nochmal angesehen.. Hatte da doch was verändert.
    Titel, Description und keywords angegeben.

    Und der Rest sieht so aus

    Einmal editiert, zuletzt von dummy (2. Juli 2008 um 10:49)



  • das brauchst du eigentlich nicht,

    um dir zu sagen woran es liegt brauch ich einen link ;)

    lg

  • Das sieht komisch aus:

    Zitat

    Disallow: /*?*
    Disallow: /*?


    Wenn du keine Permalinks nutzt, also die Seiten über ?p=123 aufrufst, werden die demnach alle nicht indiziert.

    Ein Link zur URL wäre aber schön, dann könnte man sich das direkt im Quelltext anschauen.

    wpseek.com - Die WordPress-Code-Suchmaschine

  • Ohh, Je.. Ist mir so peinlich meine Seite anzugeben :oops:.
    Anime - Subs & Cuts

    EDIT: Ich rufe meine Seiten tatsächlich mit /?p=123 auf.. Habe die robots.txt mal geändert.

    User-Agent: *
    Disallow: /wp-includes
    Disallow: /wp-content/plugins
    Disallow: /wp-content/themes
    Disallow: /wp-admin
    Allow: /

    Ich möchte also alles zualssen, außer: /wp-includes, /wp-content/plugins, /wp-content/themes und /wp-admin.
    Ich hoffe das ist so richtig, damit der Seiteninhalt endlich gecrawlt wird.

    Einmal editiert, zuletzt von dummy (2. Juli 2008 um 11:15)

  • Muss dir doch nicht peinlich sein. :)

    Da du wie gesagt keine Permalinks nutzt (also ?p=123), muss das hier raus:

    Code
    Disallow: /*?*
    Disallow: /*?


    aus der robots.txt. Dann sollte alles wieder indexiert werden. :)

    wpseek.com - Die WordPress-Code-Suchmaschine

  • Vielen dank.
    Werde nun beobachten, wie sich die Änderungen auf das crawling Verhalten auswirken, sobald Google die neue robots.txt annimmt.

  • Ich habe einen [SIZE=-1]Webmaster-Tools account bei Google. Meinst du das?
    Aber ich finde dort nirgends eine Option Sitemaps im [/SIZE]Vorfeld zu testen. Das Einzige was ich dort sehe ist robots.txt analysieren. Bei Sitemaps habe ich aber noch keine neue Sitemap hoch geladen. Ich lass Google mal selber nach dem Inhalt suchen. Immer wenn ich eine hochlade, gibt es plötzlich Fehler für URLs in XML-Sitemaps. Eigentlich hat Google auch ohne Sitemap immer alle Seiten gefunden. Ich habe erst Probleme mit dem Crawlen, seid dem ich mich mit robots und sitemaps befasse :) ..

  • Zitat

    Das Einzige was ich dort sehe ist robots.txt analysieren


    Ja und haste das mal getestet?

    "Eine gut gestellte Frage ist schon halb beantwortet."

  • Ja, ich hab es getestet, sieht alles ganz gut aus. Hab gerade mein Googlebot angeschaut, es wurden sogar schon 10 Seiten gecrawlt :).
    Meine geänderte robots.txt wurde vor kurzem auch von google neu runtergeladen.

    Einmal editiert, zuletzt von dummy (2. Juli 2008 um 22:26)

Jetzt mitmachen!

Sie haben noch kein Benutzerkonto auf unserer Seite? Registrieren Sie sich kostenlos und nehmen Sie an unserer Community teil!