SEO

Index Bloat: Was ist das und wie beheben Sie es?

Talha Aslan 16 Minuten Lesezeit 3 Aufrufe

Was ist Index Bloat?

Index Bloat ist ein Zustand, in dem wertlose Seiten im Google Index mehr Platz belegen als Ihre wichtigen Seiten. Filterparameter, Tag Archive, Paginierung und doppelte URLs lösen ihn meist aus. Dadurch konkurrieren Ihre besten Seiten in einem überfüllten Pool.

Ein einfacher Test hilft. Liegt die Zahl der indexierten URLs deutlich über der Zahl der Seiten, die Ihre Website haben sollte, dann liegt vermutlich Index Bloat vor. Denn das Problem ist nicht die Zahl selbst. Das Problem ist die Qualität der überzähligen Seiten.

Zum Beispiel: Ein Shop mit 400 Produkten hat 12.000 indexierte URLs. Den Großteil des Überschusses erzeugen vermutlich Filter und Sortierungen. Unser Team sieht dieses Muster häufig bei technischen SEO Analysen.

Außerdem gibt es eine versteckte Seite. Jede sinnlose indexierte Seite verwischt die Aussage, worum es auf Ihrer Website geht. Index Bloat ist daher nicht nur eine Aufräumaufgabe, sondern auch eine Frage der Content Strategie.

Warum schadet Index Bloat der SEO?

Konkret zeigt sich der Schaden auf drei Ebenen. Erstens verschwenden Sie Crawl Zeit. Zweitens verwässern Ihre Qualitätssignale. Drittens konkurrieren Ihre eigenen Seiten um dieselbe Suchanfrage.

  • Crawl Verschwendung: Googlebot verbringt Zeit mit wertlosen URLs und erreicht Ihre neuen Seiten später.
  • Qualitätsverwässerung: Dünne und doppelte Seiten senken den Gesamteindruck der Website.
  • Selbstkonkurrenz: Mehrere URLs für eine Suchabsicht teilen Ihre Ranking Signale.
  • Verrauschte Berichte: Die Search Console füllt sich mit Ballast, daher erkennen Sie echte Probleme schwerer.

Allerdings sollten wir ehrlich bleiben. Google sagt, dass das Crawl Budget vor allem bei sehr großen und häufig aktualisierten Websites ein Thema ist. Die Einzelheiten finden Sie zudem im Crawl Budget Leitfaden. Bei kleinen Websites ist Bloat eher ein Qualitäts und Verwirrungsproblem als ein Crawl Problem.

Nicht jede Website braucht also Alarm. Trotzdem sollten Sie das Thema ernst nehmen, wenn Ihre Website einige hundert Seiten hat und der Index das Dreifache enthält.

Worin unterscheidet sich Index Bloat vom Crawl Budget?

Beide Begriffe verwechselt man leicht, dabei meinen sie Verschiedenes. Crawling bedeutet, dass Googlebot eine Seite besucht. Indexierung bedeutet, dass Google die Seite in den Pool aufnimmt, der in Suchergebnissen erscheinen kann. Eine URL kann gecrawlt sein, ohne indexiert zu sein, und sie kann sogar ohne Crawl im Index stehen.

Daher bestimmt dieser Unterschied Ihre Lösung. Dann wollen Sie das Crawling senken, nutzen Sie robots.txt. Soll eine Seite aus dem Index verschwinden, brauchen Sie noindex. Beides zu kombinieren geht oft schief, und den Grund erklären wir weiter unten.

BegriffBedeutungWichtigstes Mittel
CrawlingGooglebot besucht die URLrobots.txt, interne Links
IndexierungDie URL gelangt in den durchsuchbaren Poolnoindex, Canonical, 404/410
RankingDie URL erhält eine Position in den ErgebnissenInhaltsqualität, Links

Kurz gesagt sind "Googlebot soll diese Seiten nicht sehen" und "diese Seiten sollen nicht im Index stehen" zwei verschiedene Ziele. Entscheiden Sie zunächst, welches Sie wollen. Danach wählen Sie das Werkzeug. So vermeiden Sie jahrelange Fehlgriffe.

Welche Ursachen hat Index Bloat am häufigsten?

Die meisten Quellen stammen aus CMS Voreinstellungen, Filterlogik und alten Strukturen, die Sie vergessen haben. Die folgende Liste zeigt die Ursachen, die wir in der Praxis am häufigsten sehen.

  • Filter, Sortier und interne Such URLs mit Parametern.
  • Tag, Autoren, Datums und Kategorie Archive.
  • Session IDs und Tracking Parameter.
  • Paginierung und "alle anzeigen" Varianten.
  • Dubletten aus HTTP/HTTPS, www/ohne www und Schrägstrich am Ende.
  • Test, Staging und Reste alter Themes.
  • Anhangsseiten.
  • Leere Kategorien und Produktseiten ohne Lagerbestand.

Denn jede Ursache braucht eine eigene Lösung. Verzichten Sie deshalb auf den blinden Reflex, alles auf noindex zu setzen. Messen Sie zunächst, wie viele URLs jede Quelle erzeugt.

Zudem wirken meist mehrere Ursachen gleichzeitig. Eine Filterseite kann einen Parameter, eine Paginierung und ein Tracking Kürzel auf einmal hinzufügen. Danach trennen Sie die Quellen nicht, dann erkennen Sie nicht, welche Korrektur geholfen hat.

Wie führen URL Parameter zu Index Bloat?

Ein Filterlink erzeugt bei jedem Klick eine neue URL. Zudem kombinieren Sie Farben, Größen, Preise und Sortierungen, dann wächst ein Katalog mit einigen hundert Produkten auf Tausende Kombinationen. Googlebot findet diese Links in Ihren Seiten und beginnt zu crawlen.

Hier ein Beispiel. Fünf Farben, sechs Größen, vier Sortierungen und drei Preisbereiche ergeben 5 x 6 x 4 x 3 = 360 Kombinationen in einer Kategorie. Bei 30 Kategorien entstehen über 10.000 erreichbare URLs. Die Zahlen dienen nur der Veranschaulichung und stammen nicht von einem echten Kunden.

Die Anleitung von Google Search Central zur Facettennavigation nennt eine klare Reihenfolge. Sie beschreibt robots.txt als wirksamste Methode, um das Crawling von Facetten URLs zu stoppen. Canonical und nofollow erscheinen als schwächere Optionen auf lange Sicht.

Das ganze Bild zeigt unser Ratgeber zu URL Parametern. Dort behandeln wir jeden Parametertyp und seine SEO Wirkung. In diesem Beitrag konzentrieren wir uns darauf, wie Parameter in den Index gelangen und wie Sie das Leck schließen.

Warum blähen Tag, Archiv und Paginierungs URLs den Index auf?

Systeme wie WordPress listen einen Beitrag in Kategorie, Tag, Autoren und Datumsarchiven. Jedes Archiv wiederholt dieselben Auszüge in anderer Reihenfolge. Ein Beitrag steckt also in vier oder fünf URLs.

Tags sind besonders riskant. Dann vergeben Sie zehn Tags pro Beitrag, und jeder Tag enthält nur ein oder zwei Beiträge, dann haben Sie zehn dünne Seiten. Die meisten davon beantworten keine echte Suchanfrage.

Die Paginierung ist ein anderer Fall. Seite 2, 3 und 4 einer Kategorie können der einzige Weg zu tieferen Produkten sein. Ein pauschales noindex auf Paginierung kann daher die Entdeckung schwächen. Die richtige Entscheidung hängt von Ihrer internen Linkarchitektur ab.

Nutzen Sie eine praktische Regel. Bietet eine Archivseite einem Suchenden keine nützliche Liste, sollte sie nicht im Index bleiben. Bei einem Blog mit einem Autor ist das Autorenarchiv eine Kopie der Startseite. Datumsarchive treffen fast nie eine Suchabsicht.

Wie vergrößern doppelte Inhalte und Canonical Fehler den Index?

Zeigen mehrere Adressen denselben Inhalt, wählt Google eine davon als Canonical. Nennen Sie Ihre Wahl nicht klar, entscheidet Google allein. Manchmal wählt es eine URL, die Sie nie wollten.

Typische Dublettenquellen sind diese:

  1. Die Versionen mit http und https bleiben beide offen.
  2. Die Versionen mit www und ohne www laufen parallel.
  3. Adressen mit und ohne Schrägstrich am Ende antworten beide.
  4. Adressen in Groß und Kleinschreibung laden beide.
  5. Alte Druck oder AMP Varianten bleiben online.

Die Lösung ist ein sauberes Canonical und 301 Setup. Der Leitfaden zum Zusammenführen doppelter URLs erklärt die Methoden Schritt für Schritt. Zur Kontrolle Ihrer Weiterleitungen nutzen Sie unseren Redirect Checker und lesen den Beitrag zu Weiterleitungsketten.

Denken Sie daran, dass ein Canonical Tag ein Hinweis ist und kein Befehl. Unterscheiden sich die Inhalte, kann Google ihn ignorieren. Verwenden Sie Canonical daher nie, um Seiten zusammenzuführen, die keine echten Dubletten sind.

Wie gelangen Staging und Altlasten in den Index?

Starten Sie eine Website, ohne die Entwicklungsumgebung zu schließen, kann Google auch diese Kopie indexieren. Eine Staging Adresse spiegelt die Live Seite exakt, deshalb entsteht ein vollständiger Dublettenpool. Dieses Problem begegnet Ihnen am häufigsten bei Relaunches.

Alte Kampagnenseiten, gelöschte PDFs, die trotzdem erreichbar bleiben, und verlassene Unterordner gehören zur selben Gruppe. Sie haben diese Seiten vermutlich vergessen, denn niemand pflegt sie mehr. Google hat das nicht.

Der richtige Schutz für Staging ist ein Passwort mit IP Beschränkung. Also genügt eine Sperre in robots.txt allein nicht. Eine gesperrte URL kann trotzdem im Index erscheinen, weil andere Websites auf sie verlinken.

Prüfen Sie nach einem Relaunch auch den Status alter Seiten. Sollen alte URLs 404 liefern, tun Sie das mit Absicht. Für alte Adressen mit Traffic bereiten Sie einen 301 Plan vor. Sonst verlieren Sie Wert und einen sauberen Index.

Wie erkennen Sie Index Bloat mit dem site: Operator?

Die schnellste erste Prüfung ist eine Suche nach site:ihredomain.de bei Google. Die Trefferzahl gibt einen groben Eindruck, ist aber keine exakte Messung, denn sie bleibt eine Schätzung. Danach lesen Sie die Zahl als Hinweis und nicht als Diagnose.

Den Operator können Sie auf mehrere Arten nutzen:

  • site:ihredomain.de inurl:? findet Adressen mit Parametern.
  • site:ihredomain.de inurl:tag prüft Archivstrukturen.
  • site:ihredomain.de -inurl:https sucht unsichere Versionen.
  • site:ihredomain.de intitle:"Seite 2" zeigt Reste der Paginierung.

Der Operator zeigt eine Schätzung, und sie kann schwanken. Stützen Sie Ihre Entscheidungen daher auf Search Console und Serverdaten statt auf die site: Zahl.

Für eine schnelle Stichprobe taugt der Operator trotzdem hervorragend. Seltsame Titel, wiederholte Beschreibungen und leere Seiten verraten Ihnen in Minuten viel. Zudem notieren Sie jedes Muster, denn diese Muster bilden im nächsten Schritt Ihre Filterliste.

Wie zeigt die Search Console Index Bloat?

Die richtige Quelle ist der Seitenindexierungsbericht in der Search Console. Die Einzelheiten finden Sie zudem auf der Hilfeseite zum Seitenindexierungsbericht. Dann vergleichen Sie die Zahl der indexierten Seiten mit der Zahl der URLs, die Ihre Website haben sollte.

Achten Sie auf diese ersten Signale:

  • Die Zahl indexierter Seiten liegt weit über der URL Zahl in Ihrer Sitemap.
  • Die Zahl "Crawled - currently not indexed" steigt schnell.
  • Unter "Duplicate without user selected canonical" erscheinen Tausende URLs.
  • Die Gruppe "Alternate page with proper canonical tag" wächst stärker als erwartet.

Die Status Bezeichnungen sehen je nach Sprache Ihrer Oberfläche anders aus. Außerdem zeigt der Bericht Crawling Statistiken unter Einstellungen, auf welche URL Typen Googlebot Zeit verwendet. Zur allgemeinen Nutzung lesen Sie unsere Search Console Anleitung.

Klicken Sie auf einen Status, dann listet die Search Console Beispiel URLs auf. Danach exportieren Sie die Liste und sortieren Sie sie nach Mustern. Hunderte Adressen, die zufällig wirken, stammen oft aus nur drei oder vier Templates.

Wie messen Sie Bloat im Vergleich von Sitemap und Index?

Es gibt eine einfache, aber starke Methode. Stellen Sie die URL Zahl Ihrer Sitemap neben die Zahl der indexierten URLs. Die Sitemap ist Ihre Liste der Seiten, die im Index stehen sollen. Eine große Lücke heißt, dass der Index Seiten enthält, die Sie nicht wollen.

Ein Beispiel. Ihre Sitemap enthält 1.200 URLs, und die Search Console zeigt 4.800 indexierte Seiten. Somit liegen 3.600 URLs außerhalb der Sitemap. Zudem gruppieren Sie diesen Überschuss nach Quelle: Parameter, Archive, Dubletten und Sonstiges.

Denn diese Messung braucht eine saubere Sitemap. URLs mit noindex oder Weiterleitung in der Sitemap verfälschen den Vergleich. Unser XML Sitemap Generator und der Beitrag zu sitemap lastmod helfen bei dieser Bereinigung.

Berechnen Sie auch das Verhältnis. Dann teilen Sie die Indexzahl durch die Sitemap Zahl und erwarten Sie einen Wert nahe 1,0. Als Startbereich aus unserer Praxis beginnen wir mit der Prüfung, sobald das Verhältnis 1,5 übersteigt. Diese Schwelle ist ein Warnzeichen, keine offizielle Regel und keine Garantie.

Was sagen Server Logs über Index Bloat aus?

Logdateien sind die einzige exakte Quelle dafür, wohin Googlebot wirklich geht. Die Search Console liefert Stichproben, die Logs liefern die rohe Wahrheit. Deshalb bilden Logs die Basis der Bloat Analyse bei großen Websites.

Aus den Logs beantworten Sie Fragen wie diese:

  • Welcher Anteil der Googlebot Anfragen trifft Parameter URLs?
  • Welcher Ordner erhält das meiste Crawling?
  • Welche 404 und 301 URLs ruft Googlebot immer wieder ab?
  • Nach wie vielen Tagen besucht Googlebot eine neue Seite zum ersten Mal?

Wächst die Antwort auf die letzte Frage, kann Crawl Verschwendung real wirken. Dieses Bild beschreiben wir aus anderer Sicht im Beitrag zur sinkenden Crawl Rate.

Prüfen Sie bei der Analyse, ob der Besucher wirklich Googlebot ist. User Agents lassen sich leicht fälschen, also führen Sie eine Reverse DNS Prüfung durch. Sonst zählen Sie falsche Bots als Googlebot und ziehen den falschen Schluss.

Welche Lösung passt zu welcher Situation?

Keine einzelne Methode löst alles. Sie wählen ein Werkzeug passend zum Zweck jedes URL Typs. Die folgende Tabelle fasst die Zuordnungen zusammen, die unsere Entscheidungen leiten.

SituationEmpfohlene LösungWorauf Sie achten
Wertlose Seite, die niemand nutzt404 oder 410Auch interne Links bereinigen
Verschobene oder zusammengelegte Seite301 WeiterleitungKeine Ketten bauen
Dublette, die Nutzer noch brauchenrel=canonicalInhalt muss wirklich gleich sein
Nützlich für Nutzer, nutzlos in der SuchenoindexNicht in robots.txt sperren
Endlose Filterkombinationenrobots.txt disallowZuerst den Abgang aus dem Index abwarten

Diese Tabelle ist ein Startrahmen und kein Rezept. Plattform, CMS Grenzen und Entwicklerkapazität prägen die Wahl ebenfalls. Prüfen Sie daher für jede Zeile Traffic und Linkwert, bevor Sie entscheiden.

Zum Beispiel: Bringt eine Tag Seite Traffic, halten Sie vor dem noindex inne. Danach schauen Sie zuerst, bei welchen Suchanfragen sie erscheint. Sie zu einer echten Themenseite auszubauen, ist manchmal besser als Löschen.

Was passiert, wenn Sie noindex mit robots.txt kombinieren?

Das ist der häufigste Fehler. Sie setzen noindex auf eine Seite und sperren dieselbe Seite dann in robots.txt. Googlebot kann die Seite nicht crawlen, also sieht er das noindex Tag nie.

Die noindex Dokumentation von Google sagt das klar. Damit noindex wirkt, darf die Seite nicht durch robots.txt gesperrt sein, und der Crawler muss sie erreichen können. Eine gesperrte Seite kann weiter in den Ergebnissen stehen, weil andere Websites auf sie verlinken.

Konkret sieht die richtige Reihenfolge so aus. Zudem setzen Sie zuerst noindex. Bestätigen Sie in der Search Console, dass die Seiten den Index verlassen haben. Erst danach sperren Sie bei Bedarf das Crawling mit robots.txt. Die Datei bauen Sie mit unserem robots.txt Generator, und typische Fehler vermeiden Sie mit dem Beitrag zu robots.txt Fehlern.

Noindex können Sie auf zwei Wegen ausliefern: per Meta Robots Tag im HTML oder per X-Robots-Tag im HTTP Header. Bei Dateien ohne HTML wie PDFs funktioniert nur der Header. Dann testen Sie in beiden Fällen mit dem URL Prüftool, dass Googlebot die Anweisung sieht.

Wie bereinigen Sie den Index Schritt für Schritt?

Denn ein planvolles Vorgehen senkt das Risiko und beschleunigt das Ergebnis. Diesen Ablauf empfiehlt unser Team:

  1. Exportieren Sie die indexierten URLs und gruppieren Sie sie nach Typ.
  2. Prüfen Sie Traffic, Links und Umsatz jeder Gruppe.
  3. Entscheiden Sie für jede wertlose Gruppe zwischen 404, 410, 301, Canonical oder noindex.
  4. Schließen Sie die Quelle: Filterlinks, Tag Seiten und Template Fehler.
  5. Reichen Sie eine saubere Sitemap ein.
  6. Beobachten Sie die Ergebnisse 4 bis 8 Wochen wöchentlich.

Schritt vier überspringen die meisten. Danach schließen Sie die Quelle nicht, baut das System die bereinigten URLs innerhalb weniger Wochen neu. Eine Bloat Lösung ist daher keine einmalige Aufräumaktion, sondern eine Korrektur auf Template Ebene.

Google aktualisiert den Indexstatus manchmal langsam. Sie brauchen also Geduld, aber die Trendlinie in der Search Console zeigt Ihnen den Fortschritt.

Außerdem empfehlen wir, Änderungen in Stufen auszurollen. Zudem testen Sie zuerst eine URL Gruppe, beobachten Sie die Ergebnisse und gehen Sie dann zur nächsten Gruppe über. So senken Sie das Risiko, wertvolle Seiten durch eine falsche Regel zu verlieren.

Ist Content Pruning dasselbe wie Index Bereinigung?

Nein, aber beides ergänzt sich. Content Pruning prüft die echten Inhaltsseiten Ihrer Website: aktualisieren, zusammenlegen, weiterleiten oder löschen. Die Index Bereinigung befasst sich meist mit technischen URLs, die Ihr System erzeugt.

Ein Beispiel trennt beides. Einen alten Blogbeitrag zu aktualisieren ist eine Pruning Entscheidung. Tag Archive auf noindex zu setzen ist eine Bloat Entscheidung. Beides hebt die Indexqualität, braucht aber andere Personen und andere Werkzeuge.

Den inhaltlichen Teil des Entscheidungsbaums finden Sie im Beitrag zu Content Pruning. Legen Sie beide Aufgaben in denselben Kalender, erholt sich Ihr Indexprofil schneller.

Planen Sie auch die Reihenfolge. Dann schließen Sie zuerst die technische Quelle und gehen Sie dann zum Content Pruning über. Inhalte zu bereinigen, solange das technische Leck offen bleibt, gleicht dem Füllen eines Eimers mit Loch.

Warum trifft Index Bloat Onlineshops häufiger?

Onlineshops sind von Natur aus URL Maschinen. Jeder Filter, jede Sortierung und jeder Lagerstatus kann eine neue Adresse erzeugen. Der Index wächst daher schnell, selbst wenn die Produktzahl klein bleibt.

Produktvarianten sind eine weitere Quelle. Öffnet jede Farbe und Größe eine eigene URL, wiederholt sich der Inhalt fast wörtlich. Canonical ist hier meist das richtige Mittel, weil Nutzer weiterhin eine Variante wählen müssen.

  • Behalten Sie Seiten ausverkaufter Produkte und empfehlen Sie ähnliche Artikel.
  • Leiten Sie dauerhaft entfernte Produkte per 301 auf die nächste Kategorie weiter.
  • Verweisen Sie Sortierparameter per Canonical auf die Hauptkategorie.
  • Setzen Sie interne Suchergebnisseiten auf noindex.

Möchten Sie hier mit unserem Team arbeiten, dann schauen Sie sich unsere E-Commerce Beratung an. Technische Bereinigung und Katalogarchitektur gehören oft zusammen.

Welche Kennzahlen beobachten Sie nach der Bereinigung?

Messen Sie den Erfolg nicht nur an einer sinkenden Indexzahl. Eine sinkende Zahl kann ein gutes Zeichen sein, aber ein schlechtes, wenn die falschen Seiten verschwinden. Lesen Sie daher mehrere Kennzahlen gemeinsam.

  • Zahl indexierter Seiten: Sie sollte sich der Sitemap Zahl nähern.
  • Organische Klicks: Die Klicks auf Ihre Kernseiten dürfen nicht fallen.
  • Crawling Statistiken: Der Crawl Anteil wertvoller Ordner sollte steigen.
  • Zeit bis zur Indexierung neuer Seiten: Sie sollte kürzer werden.

Notieren Sie das Datum Ihrer Änderung. So trennen Sie Ursache und Wirkung, wenn sich der Traffic bewegt. Schwankungen in den ersten Wochen sind normal, also beobachten Sie den Trend ohne Panik.

Gruppieren Sie nach einem Monat die unerwünschten URLs, die noch im Index stehen, erneut. Ist die Restgruppe klein, funktioniert der Prozess. Ist sie groß, haben Sie die Quelle nicht vollständig geschlossen.

Welche Irrtümer zu Index Bloat sind verbreitet?

Um dieses Thema kreisen einige hartnäckige Mythen. Wer sie kennt, vermeidet unnötige Eingriffe.

  • "Ein größerer Index ist besser." Nein, die Qualität der indexierten Seiten zählt.
  • "robots.txt entfernt Seiten aus dem Index." Nein, es blockiert nur das Crawling.
  • "Canonical ist eine strenge Regel." Nein, es ist ein Hinweis für Google.
  • "Eine hohe Zahl bei Nicht indexiert in der Search Console ist schlecht." Nicht immer, denn die meisten dieser Seiten sollen ohnehin nicht im Index stehen.

Der letzte Punkt zählt am meisten, weil viele die roten und grauen Zahlen der Search Console falsch deuten. Denn die meisten nicht indexierten Seiten sind kein Problem. Sie sind das Ergebnis eines Systems, das korrekt arbeitet. Fürchten Sie also nicht jede rote Zahl, sondern lesen Sie zuerst den Grund.

Fehlen dagegen wertvolle Seiten im Index, ist das ein anderes Problem. Folgen Sie dann den Schritten in unserer Anleitung für nicht indexierte Seiten.

Wie priorisieren Sie einen Beispielfall von Index Bloat?

Machen wir den Ablauf mit einem hypothetischen Beispiel greifbar. Das ist eine Beispielrechnung und kein echter Kundenfall. Stellen Sie sich eine Unternehmenswebsite mit 800 Seiten vor, und die Search Console zeigt 3.100 indexierte URLs.

Gruppieren Sie die exportierte Liste, sehen Sie vielleicht diese Verteilung: 800 echte Seiten, 1.400 Tag und Archivseiten, 600 Parameter URLs sowie 300 Seiten aus Paginierung und Anhängen. Rund drei Viertel des Index sind somit sinnlos.

  1. Finden Sie zunächst die Quelle der 600 Parameter URLs und bereinigen Sie die internen Links.
  2. Prüfen Sie dann die Tag Seiten und setzen Sie jene ohne Traffic auf noindex.
  3. Leiten Sie Anhangsseiten auf den Hauptinhalt weiter.
  4. Entscheiden Sie schließlich über die Paginierung anhand Ihrer internen Linkstruktur.

Die Priorität bestimmen Sie nach Größe des Gewinns und Höhe des Risikos. Die Parameter Bereinigung ist groß und risikoarm, deshalb steht sie vorn. Tag Entscheidungen brauchen Traffic Daten, daher folgen sie an zweiter Stelle.

Messen Sie den Gewinn bei solchen Bereinigungen, statt ihn zu raten. Die Ergebnisse unterscheiden sich von Website zu Website stark, also lesen Sie kein Beispiel als Versprechen.

Wann sollten Sie professionelle Hilfe holen?

Bei einem kleinen Blog erledigt sich Bloat meist mit wenigen Einstellungen. Allerdings kann bei einem Shop oder einer mehrsprachigen Website mit Tausenden URLs ein falsches noindex plötzlich Traffic kosten. Somit steigt hier das Risiko.

Diese Zeichen sprechen für einen Blick von außen: ein Index, der mehrfach größer ist als die Sitemap, ein unerklärlicher Rückgang des organischen Traffics und neue Seiten, die wochenlang nicht im Index erscheinen. In solchen Fällen führen wir technische Analysen im Rahmen unserer SEO Beratung durch.

Den größeren Rahmen zeigt außerdem unser Ratgeber zu technischem SEO. Setzen Sie die Schritte dieses Beitrags selbst um, dann messen Sie in der ersten Woche nur und löschen nichts.

Häufig gestellte Fragen

Senkt Index Bloat direkt mein Google Ranking?
Nein, eine direkte Strafe gibt es dafür nicht. Allerdings verbrauchen wertlose indexierte Seiten Crawl Ressourcen, verwässern das Qualitätsbild und lassen Ihre eigenen Seiten gegeneinander antreten. Diese indirekten Effekte können sich mit der Zeit als Rankingverlust zeigen. Bei kleinen Websites bleibt die Wirkung oft begrenzt, bei großen Websites wird sie deutlich.
Wie erkenne ich Index Bloat am schnellsten?
Vergleichen Sie zuerst die Zahl indexierter Seiten im Seitenindexierungsbericht der Search Console mit der URL Zahl Ihrer Sitemap. Suchen Sie danach mit dem site: Operator nach Parameter und Archivmustern und notieren Sie die Beispiele. Ist die Lücke groß, exportieren Sie die auffälligen URLs und gruppieren sie. Die site: Zahl ist nur eine Schätzung, entscheiden Sie also nie allein danach.
Soll ich Parameter URLs auf noindex setzen oder in robots.txt sperren?
Stehen die Seiten schon im Index, setzen Sie zuerst noindex und warten ab, denn Googlebot muss die Seite crawlen, um das Tag zu sehen. Sind sie aus dem Index verschwunden, können Sie robots.txt ergänzen, um die Crawl Last zu senken. Bei endlosen Filterkombinationen nennt Google robots.txt in seiner Anleitung zur Facettennavigation als bevorzugte Methode.
Soll ich alle Tag Seiten auf noindex setzen?
Bei den meisten Websites ja, vor allem wenn jeder Tag nur sehr wenige Beiträge enthält. Funktioniert ein Tag dagegen wie eine echte Themenseite mit eigenem Text und genug Inhalt, ist es sinnvoll, ihn im Index zu lassen. Entscheiden Sie nach organischem Traffic und Inhaltstiefe jedes Tags, und testen Sie bei Unsicherheit zuerst einige Tags.
Wie lange dauert es, bis die Bereinigung wirkt?
Meist dauert es einige Wochen bis einige Monate. Google muss die URLs erneut crawlen, daher hängt der Zeitraum von Größe und Crawl Häufigkeit der Website ab. Beobachten Sie nach der Änderung 4 bis 8 Wochen lang wöchentlich den Trend in der Search Console. Dieser Bereich ist kein Versprechen, sondern ein typischer Startrahmen aus unserer Praxis.
Soll ich für entfernte Seiten 404 oder 410 nutzen?
Beide sagen Google, dass die Seite weg ist. Ein 410 zeigt klarer, dass die Entfernung dauerhaft ist, und kann die Bereinigung manchmal etwas beschleunigen, obwohl Google beide in der Praxis sehr ähnlich behandelt. Existiert eine Ersatzseite, bevorzugen Sie eine 301 Weiterleitung statt 404 und aktualisieren auch Ihre internen Links.
  • index bloat
  • technisches seo
  • search console
  • url parameter
  • canonical
  • noindex
  • crawl budget
  • index bereinigung
Teilen:
Talha Aslan

Google Partner und Experte für digitales Marketing. Seit 2012 praktisch in SEO, Google Ads, Webdesign und E-Commerce Projekten; jeder Beitrag hier stammt aus dieser Erfahrung.

Nächstes Projekt

Sprechen wir über Ihr Projekt.

Ihre Anfrage geht direkt an Talha Aslan und Team: Strategie von Talha, Umsetzung durch ein erfahrenes Team. Das Erstgespräch ist kostenlos, wir hören zu und melden uns mit einer klaren Roadmap.