SEO

WooCommerce Add to Cart URLs werden indexiert: So stoppen Sie es

Talha Aslan 15 Minuten Lesezeit 2 Aufrufe

Warum landen WooCommerce Add to Cart URLs im Google Index?

WooCommerce Add to Cart URLs sind Links mit dem Parameter ?add-to-cart= am Ende, die einen Artikel in den Warenkorb legen. Gibt Ihr Theme sie als normale Links aus, entdeckt Googlebot sie, crawlt sie und nimmt sie manchmal in den Index auf. Die Lösung: keine crawlbaren Links mehr erzeugen, dann vorhandene Adressen bereinigen und sperren.

Dieser Beitrag behandelt nur diesen einen Fall. Wir erklären, warum er entsteht, wie Sie ihn bestätigen und in welcher Reihenfolge Sie ihn sicher beheben. Allgemeine SEO Themen lassen wir bewusst aus und verweisen stattdessen auf unsere bestehenden Ratgeber.

Als Talha Aslan und Team sehen wir dieses Muster regelmäßig bei Onlineshops. Das Symptom ist fast immer gleich: Die Search Console zeigt Hunderte oder Tausende Produktadressen mit einem Parameter am Ende. Alle Schritte unten bleiben konzeptionell, Sie müssen also keinen Code in Ihren Shop einfügen.

Zunächst bestätigen wir das Problem. Dann beheben wir die Quelle, und schließlich bereinigen wir den Index. Außerdem begründen wir jede Entscheidung, damit Ihr Entwickler sie nachvollziehen kann.

Lesen Sie die Abschnitte in der angegebenen Reihenfolge. Die Reihenfolge ist wichtig, denn eine zu früh angewandte Maßnahme kann das Problem verstecken, statt es zu lösen.

Was macht der Parameter ?add-to-cart= eigentlich?

WooCommerce akzeptiert an einer Adresse einen Abfrageparameter, der ein Produkt in den Warenkorb legt. Der Parameter trägt die Produktnummer. Öffnet ein Browser diese Adresse, landet der Artikel im Warenkorb und die Seite lädt meist neu.

Anders gesagt: Die Adresse ist eine Aktion und keine Seite. Trotzdem liefert der Server eine normale Seite mit Statuscode 200 zurück. Für einen Crawler wirkt die Adresse daher wie eine fast identische Kopie der Produktseite.

Konkret heißt das: Der Server erledigt seine Aufgabe korrekt. Allerdings sieht ein Crawler nur eine Adresse und kennt ihren Zweck nicht. Daher behandelt er sie wie jede andere Seite.

Das Verhalten selbst ist kein Fehler, denn so funktioniert der Shop. Das Problem beginnt erst, wenn diese Aktionsadressen für Suchmaschinen sichtbar sind. Zum Beispiel erzeugt jede Produktkarte in Ihren Kategorieseiten eine eigene Aktionsadresse, sobald sie einen einfachen Warenkorblink enthält.

Betrachten Sie WooCommerce Add to Cart URLs deshalb in zwei Teilen. Der erste Teil ist das Serververhalten, das den Parameter liest. Der zweite Teil ist die Vorlage, die den Link anzeigt. Sie ändern die Vorlage, nicht das Serververhalten.

Wie findet Google diese Adressen?

Googlebot entdeckt neue Adressen, indem er Links auf Seiten folgt. Schreibt Ihre Vorlage den Warenkorb Button als Link, behandelt der Crawler ihn als normale Adresse. Ein nofollow Attribut kann helfen, ist aber nur ein Hinweis für Crawler und keine harte Sperre.

Die Entdeckung beschränkt sich nicht auf Links in Ihren Seiten. Auch diese Quellen können dieselben Adressen verbreiten:

  • Produktkarten auf Kategorie-, Schlagwort- und Suchergebnisseiten.
  • Parameteradressen, die ein Sitemapplugin versehentlich ergänzt.
  • Links auf anderen Websites oder in sozialen Netzwerken, die den Parameter enthalten.
  • Direkte Warenkorblinks in E-Mail und Werbekampagnen.

Zum Beispiel hält ein alter Newsletter einen direkten Warenkorblink jahrelang am Leben. Ebenso kann eine Partnerseite auf eine Parameteradresse verlinken, ohne dass Sie es erfahren. Prüfen Sie deshalb auch externe Quellen.

Kennt Google eine Adresse einmal, vergisst es sie nicht schnell. Deshalb bleiben alte Adressen oft noch eine Weile in Ihren Berichten, selbst wenn Sie die Ursache behoben haben.

Wie zeigt sich das Problem in der Search Console?

Die meisten Betreiber bemerken zuerst eine unerwartete Gruppe von Adressen im Bericht zur Seitenindexierung. Alle teilen denselben Produktpfad, nur der Parameter am Ende ändert sich. Manche erscheinen als gefunden, aber nicht indexiert, andere als gecrawlt, aber nicht indexiert.

Die Statusnamen in den Berichten können je nach Sprache und Zeitpunkt abweichen. Verlassen Sie sich daher nicht auf den genauen Bildschirmtext. Achten Sie stattdessen auf das Adressmuster: Jede Adresse mit ?add-to-cart= am Ende gehört zum selben Problem.

Prüfen Sie danach die Crawlingstatistiken auf einen auffälligen Anstieg. Machen Parameteradressen einen wachsenden Anteil aus, verbringt der Bot seine Zeit mit Aktionen statt mit echten Produktseiten. Allgemeine Ursachen für sinkende Crawlaktivität finden Sie in unserem Beitrag Googlebot crawlt weniger.

Vergleichen Sie außerdem die Zahl solcher Adressen mit der Zahl Ihrer Produkte. Ist die erste Zahl deutlich größer, liegt ein echtes Problem vor. Andernfalls handelt es sich vielleicht nur um einen kleinen Rest einer alten Kampagne.

Öffnen Sie in diesem Fall einige Beispieladressen und vergleichen Sie sie mit der Produktseite. In den meisten Fällen ist der Inhalt identisch, nur die Adresse unterscheidet sich.

Wie verbrauchen WooCommerce Add to Cart URLs Crawl Budget?

Stellen Sie sich das Crawl Budget als die Zeit und die Anzahl an Anfragen vor, die Googlebot auf Ihrer Website einsetzt. Googles Leitfaden zum Crawl Budget empfiehlt, doppelte Inhalte zu beseitigen, damit sich das Crawling auf einzigartige Inhalte statt auf einzigartige URLs konzentriert. Außerdem rät er, unwichtige Seiten per robots.txt zu sperren.

Jede Anfrage an eine der WooCommerce Add to Cart URLs verbraucht einen Teil dieses Budgets. Dieser Teil fehlt dann für echte Produkt- und Kategorieseiten. Folglich entdeckt Google neue Produkte später, und Preisänderungen erscheinen verzögert.

Auf kleinen Websites bleibt die Wirkung vielleicht gering. Bei großen Katalogen mit häufigen Änderungen wird sie dagegen sichtbar. Googles Leitfaden richtet sich an große und schnell wechselnde Websites, beurteilen Sie Ihren Fall also anhand der Search Console Daten.

In der Praxis hilft ein sauberes Setup auf einfache Weise. Googlebot erreicht Ihre neuen Produkte früher, und Ihr Server bleibt ruhiger. Deshalb betrachten wir diese Korrektur als Grundhygiene.

Wir nennen hier keine Zahlen, denn Budgets unterscheiden sich je Website und Google veröffentlicht sie nicht. Besser ist es, den Anteil der Parameteradressen in den Crawlingstatistiken über die Zeit zu beobachten.

Warum leiden Serverlast und Caching?

Eine Warenkorbadresse führt auf dem Server einen echten Vorgang aus. Eine Sitzung startet, der Warenkorb wird aktualisiert und die Antwort entsteht dynamisch. Ruft ein Bot Hunderte dieser Adressen hintereinander auf, wiederholt Ihr Server diese Arbeit jedes Mal.

Beim Caching kommt ein zweites Problem hinzu. Die offizielle WooCommerce Anleitung zum Caching sagt, dass Warenkorb, Konto und Kasse vom Cache ausgeschlossen werden sollten, weil sie kundenspezifische Informationen zeigen. Sie nennt außerdem ein Regelbeispiel, damit Warenkorbanfragen den Cache umgehen.

Zudem kann ein Cache, der Warenkorb Antworten speichert, den Warenkorb defekt wirken lassen. Kunden verlassen dann den Shop ohne Kauf. Somit ist Caching nicht nur ein SEO Thema, sondern auch ein Umsatzthema.

Überspringt Ihr Cache diese Anfragen nicht, entstehen zwei Risiken. Erstens sieht ein Besucher unter Umständen den Warenkorb eines anderen. Zweitens landet jede Botanfrage direkt auf dem Server. Zur Wahl des Hostings lesen Sie unseren Beitrag WooCommerce Hosting auswählen.

Wie sperrt die robots.txt WooCommerce Add to Cart URLs?

Eine robots.txt Datei teilt Crawlern mit, welche Adressen sie nicht abrufen sollen. Laut Googles Dokumentation dient sie hauptsächlich dazu, Ihre Website nicht mit Anfragen zu überlasten. Sie tragen ein Sperrmuster ein, das jede Adresse mit dem Parameter ?add-to-cart= erfasst.

Denken Sie das Muster so: Taucht der Parametername irgendwo in der Adresse auf, wird nicht gecrawlt. Halten Sie sich für Platzhalter und Zeilenformat an die offizielle Dokumentation und testen Sie die Regel zuerst an echten Adressen. Entwerfen Sie die Datei mit unserem robots.txt Generator.

Diese Regel senkt das Crawling, entlastet den Server und lenkt das Budget auf echte Seiten. Auch Googles Leitfaden zum Crawl Budget empfiehlt robots.txt für unwichtige Seiten. Grundlagen lesen Sie in Was ist robots.txt.

Warum reicht die robots.txt allein nicht aus?

Das Sperren des Crawlings ist nicht dasselbe wie das Sperren der Indexierung. Googles Dokumentation sagt, dass eine per robots.txt gesperrte Seite trotzdem indexiert werden kann, wenn andere Stellen im Web auf sie verlinken. Dann kann die Adresse ohne Beschreibung in den Ergebnissen erscheinen.

Sind einige Adressen bereits indexiert, entfernt eine zusätzliche robots.txt Regel sie also nicht. Schlimmer noch: Der Bot kann die Seite nicht mehr abrufen und deshalb keine Anweisung auf dieser Seite lesen. Diese Falle ist der häufigste Grund, warum solche Korrekturen scheitern.

Anders gesagt: Der Bot kann nicht befolgen, was er nie liest. Außerdem entsteht ein falsches Sicherheitsgefühl, denn die Berichte bleiben gefüllt. Kurz gesagt ist die robots.txt ein Werkzeug zur Vorbeugung und keines zur Bereinigung. Sie eignet sich gut für Adressen, die Google noch nicht indexiert hat. Für bereits indexierte Adressen brauchen Sie eine andere Reihenfolge, die die nächsten Abschnitte erklären.

Worin unterscheiden sich noindex und robots.txt?

Die beiden Werkzeuge erfüllen verschiedene Aufgaben und heben sich auf derselben Adresse gegenseitig auf. Die robots.txt steuert das Crawling, noindex steuert die Indexierung. Google erklärt, dass die Seite für noindex nicht per robots.txt gesperrt und für den Crawler erreichbar sein muss.

Merkmalrobots.txtnoindex
Was es steuertCrawlingIndexierung
Sieht der Bot die Seite?Nein, es gibt keine AnfrageJa, die Seite wird gelesen
Entfernt indexierte Adresse?Allein nichtJa
Senkt die Serverlast?JaNein, die Anfrage kommt trotzdem
Beste VerwendungUnentdeckte Adressen verhindernIndexierte Adressen bereinigen

Googles Leitfaden zum Crawl Budget warnt zusätzlich: noindex verschwendet Crawlingzeit, weil Google die Seite trotzdem abruft und dann verwirft. Wenden Sie deshalb nie beide Werkzeuge gleichzeitig auf dieselbe Adresse an. Einen ausführlichen Vergleich lesen Sie in noindex, nofollow und robots.txt im Vergleich.

Hilft ein Canonical Tag in diesem Fall?

Teilweise. Ein Canonical Tag teilt Google mit, dass die Parameteradresse eine Kopie der Hauptproduktseite ist. Zeigen Ihre Produktseiten bereits auf ihre eigene saubere Adresse als Canonical, kann die Parameterkopie dasselbe Tag tragen.

Zunächst klingt Canonical wie die perfekte Lösung. Allerdings ist Canonical nur ein Hinweis und kein Befehl. Google kann eine andere Adresse wählen. Außerdem senkt es die Crawllast nicht, denn der Bot besucht jede Adresse weiterhin.

Betrachten Sie Canonical deshalb als zweite Schicht. Die erste Schicht ist das Entfernen des Links, die dritte die robots.txt. Die Grundlagen lesen Sie in Canonical Tag: Was ist das.

Wie verhindern Sie WooCommerce Add to Cart URLs mit einem Formular oder AJAX Button?

Die eigentliche Lösung liegt an der Quelle. Ist der Button kein Link mehr, dem ein Roboter folgen kann, entstehen die Parameteradressen gar nicht erst. Es gibt zwei gängige Wege: ein Formular und eine AJAX Anfrage (eine Anfrage, die ohne Neuladen der Seite mit dem Server spricht).

Erstens vermeidet ein Formular die Adresse im Link. Zweitens bleibt die Seite für Nutzer vertraut. Beim Formular ist der Button ein Absendeelement und kein Link. Crawler folgen Formularen im Allgemeinen nicht wie Links, aber sehen Sie darin keine Garantie. Bei AJAX startet der Klick eine Anfrage innerhalb der Seite, und in der Adressleiste erscheint keine neue Adresse.

WooCommerce kann auf Archivseiten eine AJAX Option für den Warenkorb bieten. Der genaue Name der Einstellung kann sich je nach Version ändern. Prüfen Sie deshalb Ihre eigenen Produkteinstellungen und die offizielle Dokumentation. Schreibt Ihr Theme oder ein Page Builder den Button selbst, sprechen Sie mit dem Theme Entwickler.

Prüfen Sie nach der Änderung im Seitenquelltext, dass der Button nicht mehr auf eine Parameteradresse zeigt. Einen schnellen Check liefert auch unser SEO Check.

Wie prüfen Sie Cache und Sitzungseinstellungen?

Zunächst prüfen Sie, ob Ihr Cache Plugin oder Server Cache Warenkorb, Kasse und Konto ausschließt. Die offizielle WooCommerce Anleitung empfiehlt genau das. Außerdem sollten Warenkorb Cookies und Sitzungsdaten nicht im Cache landen.

Danach prüfen Sie, ob Warenkorb Anfragen den Cache umgehen. Die Anleitung enthält dafür ein Regelbeispiel. Fragen Sie Ihren Hosting Anbieter oder Entwickler, wie Sie das in Ihrer Umgebung umsetzen.

  • Sind Warenkorb, Kasse und Konto vom Cache ausgeschlossen?
  • Sind Warenkorb Cookies in den Cache Regeln als Ausnahme definiert?
  • Umgehen Warenkorb Anfragen den Cache?
  • Verhält sich der Warenkorb nach dem Leeren des Caches korrekt?

Zudem verlaufen Cache Fehler oft still. Dann melden sich zuerst verärgerte Kunden. Diese Prüfung ist für Bestellungen ebenso wichtig wie für SEO. Ein falsch gecachter Warenkorb verunsichert Kunden. Testen Sie jede Änderung deshalb zuerst in einer Testumgebung.

Wie bereinigen Sie bereits indexierte Adressen?

Die Reihenfolge ist entscheidend. Stoppen Sie zuerst neue Adressen, indem Sie den Link aus dem Button entfernen. Stellen Sie danach sicher, dass die vorhandenen Parameteradressen für den Bot sichtbar bleiben, und warten Sie, bis sie aus dem Index fallen.

Es gibt drei Wege, wie eine Adresse den Index verlässt: Die Seite trägt ein noindex Signal, die Adresse wird dauerhaft entfernt oder sie leitet auf das Hauptprodukt weiter. Welchen Weg Sie wählen, hängt von Ihrem Shop ab. Entscheiden Sie sich für eine Weiterleitung, stellen Sie sicher, dass die Warenkorb Funktion selbst weiter arbeitet.

Googles Dokumentation zum Blockieren der Indexierung nennt die Entfernen Werkzeuge der Search Console für den Fall, dass etwas schnell verschwinden muss. Betrachten Sie das als vorübergehende Maßnahme. Die dauerhafte Lösung bleibt, die Adressen an der Quelle zu stoppen.

Ergänzen Sie die robots.txt Regel erst, nachdem die Adressen aus dem Index gefallen sind. Tun Sie es früher, kann der Bot die noindex Anweisung nicht sehen, und die Adressen bleiben im Index.

Welche Reihenfolge sollten Sie einhalten?

Konkret ist die folgende Abfolge der Weg mit dem geringsten Risiko. Schließen Sie jeden Schritt ab und prüfen Sie ihn, bevor Sie zum nächsten gehen.

  1. Ermitteln Sie den Umfang des Problems in der Search Console und in den Serverprotokollen.
  2. Stellen Sie den Warenkorb Button von einem Link auf ein Formular oder AJAX um.
  3. Prüfen Sie die Cache Regeln für Warenkorb und Sitzung.
  4. Planen Sie noindex oder Weiterleitungen für die indexierten Adressen.
  5. Ergänzen Sie die robots.txt Regel, nachdem die Adressen aus dem Index gefallen sind.
  6. Prüfen Sie die Berichte nach einiger Zeit erneut.

Dokumentieren Sie außerdem jede Änderung schriftlich. Dann können Sie überraschende Berichtsänderungen zurückverfolgen. Danach teilen Sie das Protokoll mit allen, die am Shop arbeiten.

Überspringen Sie keine Schritte. Besonders das Vorziehen des robots.txt Schritts ist der häufigste Fehler und schwer rückgängig zu machen. Einen festen Zeitplan nennen wir nicht, denn er hängt von Größe und Crawl Häufigkeit Ihrer Website ab.

Arbeiten Sie mit einem Entwickler, geben Sie ihm diese Liste unverändert weiter. So folgen alle derselben Reihenfolge, und kein Schritt geht unterwegs verloren.

Wie bestätigen Sie, dass die Korrektur wirkt?

Die Überprüfung hat zwei Ebenen: Beobachten Sie die Adresserzeugung und den Indexstatus getrennt. Prüfen Sie zunächst, dass Kategorie- und Produktseiten keine Parameterlinks mehr ausgeben. Schauen Sie dazu in den Seitenquelltext oder starten Sie ein Crawling Werkzeug.

Nutzen Sie danach das URL Prüftool der Search Console für einige Beispieladressen. Googles Dokumentation empfiehlt dieses Werkzeug zur Kontrolle von noindex. Rechnen Sie damit, dass die Zahl der Parameteradressen in den Berichten mit der Zeit sinkt.

Lesen Sie außerdem Ihre Serverprotokolle. Behält dieses Muster seinen Anteil an den Bot Anfragen, ist der Button womöglich irgendwo noch ein Link. Unser Broken Link Checker hilft Ihnen, vereinzelte Links auf Ihren Seiten zu finden.

Verstehen Sie die Überprüfung nicht als einmalige Aufgabe. Kontrollieren Sie in den ersten Tagen und danach monatlich, damit Sie nach Updates zurückkehrende Probleme früh bemerken.

Welche Fehler passieren am häufigsten?

Die meisten dieser Fehler entstehen aus Eile. Zum Beispiel sieht ein Team eine lange Liste von Parameteradressen und will sie noch heute loswerden. Stattdessen führt ein ruhiges, geordnetes Vorgehen weiter.

Teams wiederholen bei diesem Thema einige Fehler. Wer sie vorher kennt, spart Zeit und Mühe.

  • Eine robots.txt Regel ergänzen und erwarten, dass indexierte Adressen von selbst verschwinden.
  • robots.txt Sperre und noindex auf derselben Adresse kombinieren.
  • Sich allein auf nofollow verlassen.
  • Die Cache Regeln für Warenkorb Anfragen nicht prüfen.
  • Eine Regel ohne Test veröffentlichen und versehentlich echte Produktseiten sperren.

Achten Sie besonders auf den letzten Punkt. Eine zu weit gefasste Regel kann echte Produktseiten mit erfassen. Deshalb testen wir jede Regel vor dem Livegang an mindestens einem Produkt, einer Kategorie und einer Warenkorb Adresse.

Bedenken Sie außerdem Plugin Konflikte. Ein SEO Plugin, ein Cache Plugin und Ihr Theme können dieselbe robots.txt auf verschiedene Weise ändern wollen.

Warum kehrt das Problem immer wieder zurück?

Die häufigste Ursache ist ein Theme oder Plugin Update. Nach einem Update kann die Button Vorlage zurückspringen, und die Parameterlinks erscheinen wieder. Führen Sie nach jedem größeren Update einen kurzen Check durch.

Die zweite Ursache sind neue Seitentypen. Fügen Sie eine Kampagnenseite oder eine Produktvitrine hinzu, nutzt sie womöglich dieselbe Button Struktur. Teilen Sie die Regel mit Ihrem Designteam.

Die dritte Ursache sind externe Links. Hat eine Werbe- oder E-Mail Kampagne einen direkten Warenkorblink verwendet, kann sich diese Adresse an anderen Stellen verbreiten. Prüfen Sie Ihre Kampagnenlinks erneut; zu Tracking Parametern lesen Sie unseren Beitrag URL Parameter und SEO.

Also lohnt sich ein fester Prüfplan nach jedem Update. Konkret genügt eine kurze Checkliste mit drei Punkten: Button, Cache, robots.txt. Somit bleibt der Aufwand gering.

Manchmal ist die Ursache schlicht eine vergessene Einstellung. Ein Entwickler entfernt zum Testen eine Cache Ausnahme und vergisst, sie wiederherzustellen. Führen Sie ein Änderungsprotokoll und notieren Sie zu jeder Änderung eine kurze Erklärung.

Sollten Kampagnen direkte Warenkorblinks nutzen?

Sie können es, aber seien Sie vorsichtig. Direkte Warenkorblinks in Anzeigen und E-Mail Nachrichten erleichtern den Kauf. Zugleich können Bots sie entdecken, sobald sie weit verbreitet sind.

Deshalb ist es sicherer, Kampagnenverkehr auf eine Landingpage zu lenken. Der Kunde sieht dort das Produkt und drückt den Button selbst. Die nötigen Tracking Parameter können Sie trotzdem ergänzen.

Eine saubere Zieladresse hilft außerdem bei Anzeigengenehmigung und Qualität. Für die Budgetplanung probieren Sie unsere kostenlosen Marketing Tools. Zu Tracking Parametern lesen Sie UTM Parameter für Kampagnen Tracking.

Schließlich gilt: Testen Sie vor dem Start, dass der Link das Warenkorb Verhalten nicht stört. Diese kleine Prüfung schützt sowohl die Nutzererfahrung als auch Ihre SEO Hygiene.

Welche verwandten Themen sollten Sie als Nächstes lesen?

Dieser Beitrag behandelt nur Warenkorb Adressen. Index Bloat ist ein breiteres Thema und hat einen eigenen Ratgeber. Das Gesamtbild finden Sie in Index Bloat: Was ist das.

Probleme mit doppelten Adressen gibt es auch auf anderen Plattformen. Zu Produktadressen unter Collections bei Shopify lesen Sie Shopify doppelte Produkt URLs. Zu Mediendateien, die in WordPress als eigene Seiten erscheinen, lesen Sie WordPress Anhangseiten.

Möchten Sie die technische SEO Ihres gesamten Shops betreuen lassen, lesen Sie unsere SEO Beratung. Unsere Seite zur E-Commerce Beratung behandelt Shopstruktur und Conversion.

Wann sollten Sie Expertenhilfe holen?

In einigen Fällen ist der Alleingang riskant. Hat Ihr Shop viel Traffic, ein komplexes Caching oder mehrere Plugins, die die robots.txt verwalten, kann ein Experte die Änderung sicher planen.

Wir geben bei dieser Arbeit keine Garantien und machen keine Ergebnisversprechen. Wann Google Adressen entfernt, liegt nicht in unserer Hand. Die richtige Reihenfolge senkt das Risiko jedoch spürbar. Wir stützen uns ausschließlich auf offizielle Dokumentation.

Vor allem sollten Sie keine Wunder erwarten. Dennoch führt die geordnete Reihenfolge zu einem deutlich saubereren Index. Außerdem entlastet sie Ihren Server.

Die Angaben hier sind ein allgemeiner Leitfaden und müssen an Ihren Shop angepasst werden. Sichern Sie vor dem Livegang alles und testen Sie Änderungen in kleinen Schritten. Offizielle Quellen finden Sie hier:

Häufig gestellte Fragen

Schaden WooCommerce Add to Cart URLs der SEO?
Ja, das können sie. Diese Adressen wirken wie Kopien der Produktseite, verbrauchen deshalb Crawl Budget, verschmutzen Ihre Berichte und belasten den Server unnötig. Einige wenige richten vielleicht kaum Schaden an. Mit wachsendem Shop vermehren sie sich jedoch schnell, daher ist Vorbeugung günstiger als spätere Bereinigung.
Entfernt die robots.txt die Adressen aus dem Index?
Nein, nicht allein. Google sagt, dass eine per robots.txt gesperrte Seite trotzdem indexiert werden kann, wenn andere Websites auf sie verlinken. Bringen Sie die Adressen zuerst aus dem Index und sperren Sie danach das Crawling. So kann der Bot das noindex Signal noch lesen und die Adressen entfernen.
Kann ich noindex und robots.txt zusammen nutzen?
Nicht auf derselben Adresse. Die robots.txt hindert den Bot daran, die Seite zu besuchen, daher sieht er das noindex Signal nie und die Anweisung greift nicht. Bereinigen Sie zuerst mit noindex und ergänzen Sie die robots.txt Regel, nachdem die Adressen verschwunden sind. Diese Reihenfolge deckt Bereinigung und künftige Crawl Last ab.
Warum sollte der Warenkorb Button kein Link sein?
Ein als Link geschriebener Button erzeugt eine Adresse, der ein Roboter folgen kann, und jede Produktkarte wird zu einer neuen Aktionsadresse. Eine Formular oder AJAX Lösung erzeugt diese Adressen nicht. Sie lösen das Problem dann an der Quelle und müssen später nicht bereinigen. Eine absolute Garantie ist das dennoch nicht.
Wie hängt Caching mit diesem Problem zusammen?
Warenkorb Anfragen sind dynamisch und sollten nicht gecacht werden. Die WooCommerce Anleitung nennt ein Regelbeispiel, damit diese Anfragen den Cache umgehen. Tun sie das nicht, wird womöglich ein falscher Warenkorb angezeigt, oder jede Bot Anfrage erreicht den Server direkt. Prüfen Sie Ihre Einstellungen gemeinsam mit Ihrem Hosting Anbieter.
Wie lange dauert es, bis die Korrektur wirkt?
Eine genaue Dauer können wir nicht nennen. Wann Google die Adressen erneut crawlt und entfernt, hängt von Größe und Crawl Häufigkeit Ihrer Website ab. Bestätigen Sie zuerst, dass keine neuen Adressen mehr entstehen, und prüfen Sie die Berichte dann in regelmäßigen Abständen. Geduld und die richtige Reihenfolge zählen mehr als Tempo.
  • woocommerce seo
  • add to cart
  • robots.txt
  • noindex
  • crawl budget
  • url parameter
  • e-commerce seo
Teilen:
Talha Aslan

Google Partner und Experte für digitales Marketing. Seit 2012 praktisch in SEO, Google Ads, Webdesign und E-Commerce Projekten; jeder Beitrag hier stammt aus dieser Erfahrung.

Nächstes Projekt

Sprechen wir über Ihr Projekt.

Ihre Anfrage geht direkt an Talha Aslan und Team: Strategie von Talha, Umsetzung durch ein erfahrenes Team. Das Erstgespräch ist kostenlos, wir hören zu und melden uns mit einer klaren Roadmap.