Beiträge von Putzlowitsch

    Wahrscheinlich hat mit immer nicht zu tun.

    Die robots.txt hat auch nichts mit dem Ausschluss einer Seite aus dem Index zu tun. Sie dient nur zur Steuerung des Zugriffs der Suchmaschinen-Bots auf die Inhalte. Kannst oder willst Du das nicht verstehen?

    Wenn ich in der robots.txt Seiten oder Verzeichnisse ausschließe, dann werden sie vom Crawler nicht abgerufen. Daß sie wahrscheinlich aus dem Index entfernt werden, ist nur ein Nebeneffekt.

    Zitat aus der Google-Hilfe:

    Zitat

    Wenn deine Seite über eine robots.txt-Datei blockiert ist, kann sie zwar weiterhin in den Suchergebnissen erscheinen, aber das betreffende Suchergebnis enthält keine Beschreibung und sieht in etwa so aus. Bilddateien, Videodateien, PDFs und andere Nicht-HTML-Dateien werden ausgeschlossen.

    Für "Medien" ist es sogar so, daß diese durch die robots.txt auch tatsächlich aus dem Index ausgeschlossen werden.

    Gruß
    Ingo

    Eine Unterseite deiner Seite die nicht in deiner Seite verlinkt ist kann indexiert werden wenn ein Mensch,oder Bot diese URL in einem Forum, einer webseite, selbst in einem Email verlinkt hat.

    Achso, ja, das nennt sich Backlink und ist ein fundamentales Prinzip des Internets. Das WWW basiert ja darauf, das Seiten nicht nur sich selbst, sondern auch andere Seiten verklinken.

    Das hat aber alles nichts mit der robots.txt und damit zu tun, ob der Google-Bot diese respektiert oder nicht.

    Deine Erfahrungen in Ehren nur lassen sich die wohl schlecht auf die Masse im Internet übertragen.

    Es ist sicher richtig, daß Einzelerfahrungen nicht repräsentativ sind, aber warum sollte der Google-Bot meine Seiten anders behandeln als alle anderen Seiten?

    Deine Aussagen und Beispiele weiter oben stellen übrigens auch nur einzelne Beispiele dar und können ebenso wohl kaum "auf die Masse im Internet übertragen" werden.

    Gruß
    Ingo

    Selbst eine nicht verlinkte URL einer Seite die du verlinkt hast und Google bekommt das mit, erscheint irgendwann einmal im Index.


    Verstehe ich nicht. Ist die Seite nun verlinkt oder nicht?

    Oder meinst Du eine URL, die nur als Plain-Text auf einer Seite steht und gar nicht per 'a href=...' eingebunden ist?
    Ja, das ist bei Google tatsächlich so, da wird gerne alles, was wie eine URL aussieht, erfaßt. Aber wenn diese URL in der robots.txt ausgeschlossen ist, wir der Google-Bot den Inhalt nicht auslesen, also die URL nicht "anfassen".

    Und noch einmal, die robots.txt steuert den Zugriff durch Suchmaschinen-Bots und nicht die Aufnahme in den Suchindex.
    Bei der Google-Bildersuche ist das übrigens etwas anders. Da bedeutet der Ausschluß in der robots.txt auch ein Entfernen der Bilder aus dem Bilder-Index.

    Gruß
    Ingo

    Robots.txt wird von Google weitgehend Ignoriert.
    Sollte die Seite von außen von jemanden verlinkt werden/sein ist sie im Index.

    Ja, das sagt Google selber, daß man mit der robots.txt nicht die Indexierung, sondern nur das Crawling steuern kann.
    Aber alles was syntaktisch korrekt für den Google-Bot in der robots.txt gesperrt ist, wird vom Google-Bot nicht "angefaßt". So zumindet meine Erfahrung.

    Gruß
    Ingo

    Das stelle ich mir wirklich unangenehm vor. Mein Sohn hat dieses Problem übrigens auch. Ich habe mich ausführlich bei nformiert und er benutzt nun auch aus diesem Shop das Mittel gegen Warzen. Seitdem ist es viel besser geworden. Die Info-Seite ist verständlich geschrieben und zielt nicht darauf ab, dass die unbedingt ihre Produkte verkaufen wollen. Sehr sympathisch also. Mach dich dort doch mal schlau zum Problem.

    Hab ich es nicht gesagt, da kommt BlueAggi (Blaue Agnes) bestimmt mit einer Idee um die Ecke und hat auch gleich einen passenden Link dabei, sie wie hier z.B.:
    https://forum.wpde.org/threads/mamas-geduld.190574/

    So sieht Linkbuilding mit Forenlinks aus. Auch Forenlinks gehören zu einem guten Linkmix, selbst wenn oder gerade weil sie "NoFollow" sind.

    Gruß
    Ingo

    Ich selbst habe bei Strato nur ein "normales" Hostingpaket (Hosting Plus). Ich weiß nicht, was bei den Wordpress-Paketen anders konfiguriert ist, aber bei mir stehen die 256MB tatsächlich zur Verfügung.

    Testen kann man das mit einem einfachen PHP-Skript. Datei herunterladen, entpacken, per FTP auf der Server hochladen und aufrufen.
    Das Skript fordert in einer Endlosschleife Speicher an (erzeugt ein neues Bild per GD) und läuft halt nur so lange, bis das Speicherlimit erreicht ist.

    Im Logfile findet man dann so etwas:

    Code
    PHP Fatal error:  Allowed memory size of 268435456 bytes exhausted (tried to allocate 4096 bytes)

    Gruß
    Ingo

    PHP Fatal error: Out of memory (allocated 4194304)

    Was mich nur etwas irritiert, das da auch andere Werte stehen:
    PHP Fatal error: Out of memory (allocated 8388608)
    PHP Fatal error: Out of memory (allocated 12582912)

    Also stehen manchmal 4MB, 8MB oder 12MB Arbeitsspeicher zur Verfügung.
    Und "Out of Memory" hat auch nichts mit dem PHP-Memory-Limit (Parameter memory_limit) zu tun. Das kommt vom übergeordneten Prozess, also z.B. der Speicherverwaltung des Betriebssystems.

    Interessant wäre noch zu wissen, welches Webhosting-Paket genau verwendet wird und wie alt es ist.

    Gruß
    Ingo

    ich bin davon ausgegangen, dass ich das mir zur Verfügung stehende Speichervolumen erst einmal mit meinen Fotos ausnutzen kann

    Das hat jetzt auch nicht mit dem Speicherplatz für Daten auf dem Webspace zu tun. Es sind einfach zu viele Bilder auf der einzelnen Seite, so daß der Edior damit überfordert ist, auch wenn die Bilder selbst nicht den PHP-Arbbeitsspeicher belasten. Vermutlich wird aber für das Laden der Seite in den Editor mehr Speicher verbraucht, als zur Verfügung steht.

    Vielleicht hilft es ja schon, vom "Visuellen Editor" auf den "Text-Editor" umzuschalten. Dann könnt man mal testweise eine paar der Bilder rausnehen.

    Gruß
    Ingo

    Der Fehler 500 wird nicht von den Requests zum Laden einzelner Bilder im Browser ausgelöst, sondern von der Editor Seite, was auch immer WordPress da serverseitig macht.


    Das ist mir schon klar, aber wenn eben die 800 Bilder im Editor geladen werden sollen, scheint ja der Speicher nicht zu reichen ("Out of Memory").

    dann kann man weiter auf die eigentliche Problemsuche gehen.


    Aus meiner Sicht ist das Problem einfach, daß die Seite zu viele Bilder enthält und deshalb den Editor speichertechnisch "sprengt".

    Gruß
    Ingo

    Hmmm, beim Aufruf der Seite sagt mir die Netzwerkanalyse vom Browser, daß gut 800 Bilder geladen werden die zusammen 115 MB "auf die Waage bringen". Was im Frontend dank Lazyload noch halbwegs funktioniert, scheint im Backend den Wordpress-Editor zu überfordern.

    Generell ist es keine gute Idee, derartig viele Bilder in voller Größe direkt auf eine Seite zu packen. Besser wäre hier wohl eine Galerie mit Thumbnails die beim Anklicken das Originalbild zeigt. Oder anders gesagt, die Seite ist einfach zu "fett".

    Gruß
    Ingo

    Du meinst das es falsche Google Spider waren?


    Auch, aber es gab auch Probleme weil die Groß-/Kleinschreibung nicht berücksichtigt wurde.

    Ist möglich, nur meine Erfahrungen besagen das Google eigentlich alles Indexed was verlinkt ist.


    Ja, das sagt Google selber, daß man mit der robots.txt nicht die Indexierung, sondern nur das Crawling steuern kann.
    Aber alles was syntaktisch korrekt für den Google-Bot in der robots.txt gesperrt ist, wird vom Google-Bot nicht "angefaßt". So zumindet meine Erfahrung.

    Gruß
    Ingo