Beiträge von Tooni

    Danke für die weiteren Ideen/Hinweise. Ich will gerne noch einmal präzisieren, was ich bisher feststellen konnte:
    * Die Meldungen über die "gecrawlten, aber zurzeit nicht indexierten Seiten" stammen alle von der Google Search Console.
    * Es sind immer urls, die NUR meine Domain betreffen, häufig nach dem Muster:
    meine-domain/existierende Seite/?replytocom=35843
    meine-domain/existierende Seite/?hilite='such-string1'
    manchmal auch beides kombiniert, also: meine-domain/existierende Seite/?hilite='such-string1'/?replytocom=35843
    manchmal auch mit einer merkwürdigen Syntax (mehrere Schrägstriche u.ä.)
    * Es sind inzwischen sehr viele dieser Meldungen: Bei ca. 400 korrekt indexierten Seiten sind es knapp 40.000 Seiten mit dem beschriebenen Problem.
    * Eine stichprobenartige Detail-Prüfung einzelner Meldungen, ergibt überall, dass die verweisende Seite(n) ebenfalls von meiner Domain stammen und auch dasselbe Muster aufweisen, also z.B. meine-domain/existierende Seite/?hilite='such-string1'. Oftmals ist die untersuchte url identisch mit der verweisenden Seite. Manchmal gibt es auch mehrere verweisende Seiten, dann aber alle von meiner Domain und alle mit einem der fraglichen Muster.
    * Für den ?replytocom Parameter habe ich komplett keine Erklärung.
    * Der ?hilite Parameter stammt von einem Plugin, welches auf der Suchergebnisseite (als Ergebnis einer User-Suchfunktion) den gesuchten String farblich markiert. Somit wäre die Suchergebnisseite tatsächlich eine Seite, die mehrere Links in der Form meine-domain/existierende Seite/?hilite='such-string1' enthält. Aber nach meinem Verständnis ist die Suchergebnisseite doch eher eine temporäre Ansicht für einen User und kann daher von Google gar nicht gecrawlt werden, oder? Für die Suchergebnisseite existiert nach meinem Verständnis höchstens ein Template, welches dann jeweils für die entsprechende Anfrage gefüllt wird.
    * Das Plugin heisst "Highlights Search Terms".
    * Denn Vorschlag mit der Redirection habe ich nicht verstanden. Zum einen ist mir nicht klar, wie ich "derartige" Aufrufe erfassen soll, andererseits würde ich dann damit vermutlich die tatsächlich existierende Seite umleiten (was ich natürlich will) und letztlich: wenn es die Maßnahme Erfolg hätte, würde sich anschliessend in der Google Search Console vermutlich nur die Meldung ändern, anstatt "gecrawlt - zur Zeit nicht indexiert" dann eben "Seite mit Weiterleitung". Damit wäre nicht viel gewonnen.

    Wenn es weitere Ideen gibt: Sehr gerne!

    Danke für die bisherigen Ideen. Leider haben sie mich noch nicht weiter gebracht.
    Mein eigener Ansatz war bisher, einmal nach einem Zusammenhang mit dem oft vorkommenden url-Anhängsel ?hilite='such-string1' zu suchen. Die Ergänzung ?hilite stammt von einem Plugin, welches im Anschluss an eine Suchfunktion den gesuchten String farblich markiert.
    Somit wäre die Suchergebnisseite tatsächlich eine Seite, die mehrere Links in der Form example.com/existierende Seite/?hilite='such-string1' enthält.
    Aber nach meinem Verständnis ist die Suchergebnisseite doch eher eine temporäre Ansicht für einen User und kann daher von Google gar nicht gecrawlt werden, oder? Oder gibt es irgendwo eine Suchergebnisseite, die ich evtl. auch konfigurieren könnte und z.B. das Crawlen verbieten?

    Link zu Deiner exakten Beispielseite mit Antwortkommentaren? Viele Bots tun so als wären sie Google.


    Einen Link zu der betroffenen Seite möchte ich hier nicht veröffentlichen. Ich kann aber gerne alles prüfen und nachsehen, was zu einer Lösung führt.
    Die Aussage, dass "viele Bots so tun als wären sie Google", habe ich nicht verstanden. Mir ist zwar bewusst, dass sich einige Bots als Google-Bots tarnen - aber sie werden ja wohl kaum ihre Ergebnisse anschliessend an Google weitermelden. Aber die Meldungen über die "gecrawlten, aber zurzeit nicht indexierten Seiten" stammen ja von Google selber, genauer von der Google Search Console. Ich sehe da keine Verbindung zwischen der Google Search Console und Bots, die sich als Google-Botgs tarnen.

    Das erste Beispiel wird von WordPress auf Kommentarseiten erzeugt (mehr dazu), die anderen beiden Beispiele sind automatisierte Bots die ohne Sinn und Verstand alle mögliche SQL Injection o.ä. Schwachstellen durchprobieren, ob die bei Dir passen oder nicht...


    Ja, danke. Die Ideen sind gut, passen aber meiner Meinung nach nicht.
    Bei meinen Kommentaren gibt es zwar einen Antwort-Link, der enthält aber keinen replytocom Teil, sondern sieht so aus:
    example.com/existierende Seite/#comment-35843
    Und an die Bots habe ich auch schon gedacht, aber wenn da einer willkürlich Links probiert, dann bekommt er entweder eine Fehlermeldung (weil die Seite nicht existiert) oder bekommt die existierende Seite geliefert, weil die url-Anhängsel gar nicht verarbeitet werden. Beides wäre aber doch keine Erklärung, warum Google diese urls crawlt. Es sei denn Google selber würde ohne Sinn und Verstand willkürliche Kombinationen durchprobieren. Das halte ich für unwahrscheinlich. Oder?

    Seit einigen Monaten meldet mir Google eine immer weiter steigende Anzahl der "gecrawlten, aber zurzeit nicht indexierten Seiten". Das ist aber nicht das eigentliche Problem - sondern ich würde gerne wissen, woher Google diese urls hat. Auf meiner Seite existieren diese urls nämlich nicht. Zumindest nicht absichtlich.
    Diese fraglichen urls haben fast alle ein Muster, welches sich aus einer tatsächlichen vorhandenen Seite und verschiedenen Anhängseln zusammensetzt, also z.B.:
    example.com/existierende Seite/?replytocom=35843
    example.com/existierende Seite/?hilite='such-string1'+'/'///////////
    example.com/existierende Seite/?hilite=such-string2//////////////////
    Anm: Die mehrfachen Schrägstriche sind auch Bestandteil der beanstandeten Seiten.

    Alle diese urls sind nicht wirklich existent. Und es gibt auf meiner Seite auch keine Links, die so aussehen. Ich frage mich daher: Wie kommt Google dazu, diese urls zu crawlen?
    Danke für evtl. Tipps.

    Vorab bitte ich direkt um Entschuldigung an alle, die eine ähnliche Frage schon 100mal beantwortet haben.
    Ja - ich habe die Forensuche bemüht und ich habe auch nach den immer wieder empfohlenen FAQs gesucht, aber nicht gefunden. Entsprechende Links funktionieren nicht... :-(

    Meine Frage:
    Ich habe bereits eine bestehende WP-Installation bei All-Inkl., damals als Standard unter /wordpress installiert.
    Nun möchte ich für eine zweite Domain (bereits vorhanden, aber noch unbenutzt) ebenfalls WP nutzen.
    Die Frage: Wo ich wie installiere ich das denn jetzt am besten?

    Am Schönsten fände ich es, wenn die Installation der "alten" Domain unter /alte-domain/wordpress und die "neue" unter /neue-domain/wordpress zu finden wäre. Dazu müsste ich aber die alte verschieben, was ich nur äusserst ungern machen würde.

    Als zweite Möglichkeit könnte ich mir vorstellen, die alte Installation da zu lassen, wo sie ist und für die neue das Verzeichnis /neue-domain/wordpress zu wählen. Was müsste ich denn dazu als Installationsziel bei der Installation von WP wählen?
    Ist es /neue-domain oder /neue-domain/wordpress ? Wird das Unterverzeichnis /wordpress automatisch angelegt?

    Und ist das überhaupt ein sinnvoller Weg? Oder macht man das generell anders?

    Danke und Gruß, Tooni

    Auch das (Verbindung zu ext. Diensten) habe ich nicht.

    Was allerdings immer wieder vorkommt, ist, dass ich mit dem ersten Ergebnis meiner Bild-Einbindung nicht zufrieden bin.
    Und dann das Bild sowohl innerhalb vom WP oder auch außerhalb mit einem Bildbearbeitungsprogramm noch einmal bearbeite und dann ggfs. noch einmal neu laden muss. Und dann entstehen wohl die Anhängsel.

    Gruß, Tooni

    Zitat von Bitpalast

    Könnte es sich um einen Unix Timecode handeln (Sekunden seit 01.01.1970)?


    Sehr gut! Das ist ja zumindest schon einmal eine plausible Erklärung. Und ich bin mir sicher, dass sie richtig ist, denn die Zahlen sind nicht etwa, wie in den oben angegebenen Links "random numbers", sondern beginnen alle mit denselben Ziffern und sind aufsteigend. Das passt also. Super.

    Und es passt auch zu der Annahme, dass so doppelte Dateinamen vermieden werden sollen.

    Eine wohl eher akademische Fragestellung wäre jetzt nur noch, warum dies mal so (Timecode) und mal so ( _1 Anhang) gelöst wird?
    Und von wem oder was? Dies scheint wohl weder eine Kernel-WP-Funktion, noch eine Plugin- oder Theme-Funktion zu sein?

    Naja... und nichts dran ändern?
    Erst mal sieht es "unschön" aus, ist aus SEO-Sicht auch nicht gerade ideal. Ich fände es schon besser, das bereinigen zu können.

    Gruß, Tooni

    Ich bin da ein ziemlicher Laie und bekomme schon feuchte Hände, wenn ich nur ein Plugin updaten muss.
    Und mit "mal eben" ein anderes Theme ausprobieren, habe ich schon seehr schlechte Erfahrungen gemacht.
    Das möchte ich wirklich nicht am Live-System machen!

    Tja - und "CDN" - weiß ich gar nicht, was das ist! Hört sich kompliziert an. Habe ich ganz sicher nicht.
    Ich habe nicht mal ein Cache Plugin (weil ich Angst habe, dass das mit irgendwelchen anderen Plugins oder sonst was nicht harmonisiert).

    Also, alles sehr einfach bei mir.

    Aber ich scheine ja nicht der Einzige zu sein (s. obige Links) und außerdem scheint das auch kein neues Problem zu sein (einer der Links ist schon ein paar Jahre(!) alt). Da müsste es doch eigentlich eine Erklärung für geben... :roll:

    Gruß, Tooni

    Danke, Monika, dass Du Dich der Frage angenommen hast!

    Ich möchte die von Dir vorgeschlagenen Tests nicht wirklich mit meiner Live-Seite machen.
    Daher habe ich erst einmal mit Instant-WP angefangen.
    Aber - Überraschung: Dort verhält es sich alles genau so wie von Dir beschrieben: Anhängsel -1, -2
    Und das mit allen Plugins und aktuellen Theme.
    Hmm...??

    Ich habe dieses Problem auch an anderen Stellen gefunden, z.B. hier:
    https://www.reddit.com/r/techsupport/…e_filenames_on/
    Oder hier:
    https://wordpress.org/support/topic/…-image-file-url

    Leider ohne eine überzeugende Lösung.
    Hmm... Ratlos :roll:

    Gruß, Tooni

    Hallo,

    mir ist gerade aufgefallen, dass meine Bilder, die ich in Beiträgen verwende, teilweise mit einer langen Ziffernfolge im Filenamen ergänzt worden sind.
    Also Beispiel: Ich lade eine Datei "Neues-Bild.jpg" hoch, verlinke sie in meinem Beitrag. Alles klappt wunderbar.
    Schaue ich mir aber später den Filenamen an, so heißt dieser "Neues-Bild-e1421746366920.jpg".

    Wie gesagt: Es funktioniert alles, wie es soll. Aber ich wüsste einmal gerne, wo das her kommt?

    Ich vermute, es könnte daran liegen, dass WP hier versucht, doppelte Filenamen zu vermeiden. Aber da würde ja auch ein simples Anhängen von "-1" oder "-2" genügen. Haben diese Zahlen irgendeine Bedeutung? Kann man das vielleicht abstellen? Oder ändern?

    Kurz: Kann mir irgendjemand erklären, was der tiefere Sinn und Zweck ist? Gibt es eine Empfehlung, wie damit umzugehen ist?

    Danke und Gruß, Tooni

    Okay - da habe ich auch keine Erklärung für. WP 3.7 ist ja wohl ca. Ende 2013 erschienen. Und seitdem habe ich ganz sicher auch auf meiner lokalen Installation irgendwelche Updates durchgeführt, ohne dass ich Probleme gehabt hätte. Von daher: Keine Ahnung!

    Aber wenn ich die kostbare Zeit der hochrangigen Gurus noch einmal verschwenden darf:
    Gibt es hier denn irgendwo eine Anleitung oder etwas ähnliches, welche einem Unwissenden wie mir verständlich erläutert, wie ich eine Test-Installation (die möglichst 1:1 meine Live-Version abbildet) beim Hoster meines Vertrauens installiere, ohne dass ich Konflikte mit der Live-Version bekomme?
    Ein Link würde mir schon reichen. Vielen Dank!

    Gruß, Tooni

    Großes Dankeschön an Monika !
    Dein Beitrag und die darin enthaltenen Links haben die Lösung gebracht. Am Ende ist es ja immer ganz einfach:

    Ich habe einfach in der php.ini in meinem Installationsverzeichnis von xampp ein Semikolon entfernt:
    [COLOR=#FF0000];[/COLOR]extension=php_curl.dll

    den Server neu gestartet und seit dem läuft das wieder fehlerfrei. VIELEN DANK!!


    Aber ich bin ja auch nicht beratungsresistent und denke gerne einmal über den Vorschlag nach, die Tests auf einem gemieteten Hosting-Paket durchzuführen.
    Schließlich habe ich ja bereits eins (für meine Live-WP-Installation).
    Der Grund für meine lokale Test-Installation besteht eigentlich nur darin, eine Umgebung zu haben, die 1:1 der Live-Version entspricht, aber dennoch von außen für niemand sichtbar ist. Wie könnte ich das denn auf einem Hosting-Paket realisieren? Schließlich muss ich ja selber an diese Test-Website herankommen. Und wenn ich das kann, kann das doch jeder, oder?
    Und gibt es da nicht Konflikte mit den ganzen URLs der Original- und der Test-Site?

    Danke und Gruß, Tooni

    Okay. Danke für die Mühe.
    Leider habe ich den Eindruck, dass mich das lediglich Tage bis Wochen beschäftigt, nur um nachher festzustellen, dass das eigentlich Problem wo anders liegt.
    Du magst natürlich Recht haben und ich verstehe auch, dass sich jemand keine Gedanken über hoffnungslos veraltete Systeme machen will. Aber der Aufwand für eine komplette Neu-Installation ist mir einfach zu groß. Inklusive Risiko, dass ich das nie wieder ans Laufen bekomme.

    Gruß, Tooni

    Die ganze Installation ist ca. 3 Jahre alt und seitdem nicht aktualisiert (never change a running system!).
    Und was wäre da sinnvoller Weise zu aktualisieren? Apache? könnte ich ja mal probieren. Habe nur Bedenken, dass ich das überhaupt wieder ans Laufen bekomme.

    Also: Das Ganze läuft auf einer virtuellen Maschine (Virtual PC). Dort läuft Windows Server 2003.
    Da habe ich dann vor ein paar Jahren mal XAMPP für Windows installiert. War damals ein ganzes Paket mit Apache Server, PHP-Admin, Perl, FTP-Tools und vor allen Dinge, vieles was ich nicht verstehe. Ich war froh, als das ganze irgendwann lief. Und das tut es auch, immer noch.

    Bis auf das Problem mit dem HTTP-Transports, dass ich (vermutlich) seit einem Update von Wordpress habe. Ich nutze diese lokale Installation eher selten, daher fällt es mir nicht sofort auf. Wenn ich sie nutze, mache ich vorher immer eine Kopie meiner Life-Wordpress-Installation mit dem WP-Plugin "Duplicator".

    Gruß, Tooni