Duplicate Content: Was ist das und schadet es dem SEO?

Was ist Duplicate Content?
Duplicate Content, auf Deutsch doppelter Inhalt, liegt vor, wenn derselbe oder ein fast gleicher Text unter mehreren URLs erreichbar ist. Die Adressen können zur selben Domain gehören oder zu verschiedenen. Anschließend fasst Google sie zu einer Gruppe zusammen und wählt eine Version als Vertreter. Daher zählt am Ende nur diese eine Adresse.
Die Definition wirkt simpel, führt in der Praxis aber oft zu Verwirrung. Denn doppelter Inhalt entsteht selten mit Absicht. Meist erzeugt die technische Struktur Ihrer Website ihn von selbst, weil sie eine Seite über mehrere Adressen ausliefert.
Ein Beispiel: Eine Produktseite lässt sich über den Kategoriepfad und über eine gefilterte Adresse öffnen. Es gibt also nur eine Seite, aber zwei URLs. Somit bilden diese beiden Adressen für Google ein Duplikatpaar.
In diesem Leitfaden behandeln wir Duplicate Content anhand der offiziellen Haltung von Google. Zunächst sehen Sie die Ursachen, dann den echten Schaden und schließlich die Lösungen. Außerdem vergleichen wir Canonical Tag und 301 Weiterleitung in einer Tabelle.
Denn unser Ziel ist nicht, Ihnen Angst zu machen. Vielmehr möchten wir, dass Sie harmlose Duplikate von echten Problemen unterscheiden. Somit vermeiden Sie Arbeit, die keinen Nutzen bringt.
Bestraft Google Duplicate Content?
Nein, in der Regel nicht. Die Google Dokumentation zur Kanonisierung sagt klar, dass etwas doppelter Inhalt auf einer Website normal ist und keinen Verstoß gegen die Spam Richtlinien darstellt. Eine automatische Strafe für Duplicate Content gibt es also nicht.
Warum fürchten dennoch so viele eine Strafe? Weil die Folgen von außen wie eine Strafe aussehen. Erscheint eine Seite nicht in den Suchergebnissen, liegt die Ursache also meist in der Konsolidierung und nicht in einer Sanktion.
So funktioniert die Konsolidierung: Google sammelt URLs mit gleichem Inhalt in einem Cluster. Dann wählt es eine URL für die Anzeige in den Ergebnissen aus. Zudem erscheinen die übrigen Adressen nicht, bleiben aber auf Ihrer Website bestehen.
Hier beginnt also das eigentliche Risiko. Die URL, die Google wählt, ist möglicherweise nicht die, die Sie wollen. Gewinnt eine Parameter URL, eine alte Adresse oder eine schwache Version, verteilen sich Traffic und Signale.
Es gibt allerdings eine Ausnahme. Wer andere Websites massenhaft kopiert, ohne eigenen Mehrwert zu liefern, verstößt gegen die Spam Richtlinien. Das ist bewusstes Abschreiben und kein technisches Duplikat. Deshalb sollten Sie beides nicht verwechseln.
Worin unterscheiden sich Duplicate Content und ähnliche Inhalte?
Duplicate Content ist die exakte oder fast exakte Wiederholung desselben Textes. Ähnliche Inhalte behandeln dagegen dasselbe Thema mit anderen Worten oder aus einem anderen Blickwinkel. Deshalb geht Google mit beiden unterschiedlich um.
Zwei Seiten sind nicht schon deshalb Duplikate, weil sie ein Thema behandeln. "Was ist Duplicate Content" und "Wie funktioniert ein Canonical Tag" liegen im selben SEO Feld, beantworten aber verschiedene Fragen. Sie sind keine Kopien voneinander.
Problematisch wird es, wenn zwei Seiten dieselbe Suchabsicht mit derselben Antwort bedienen. Dann haben Sie keine Duplikate, sondern Kannibalisierung. Somit konkurrieren Ihre Seiten miteinander, und keine rankt stark.
Stellen Sie sich drei Fragen:
- Ist der Text identisch oder fast identisch?
- Beantworten die Seiten dieselbe Nutzerfrage auf dieselbe Weise?
- Würde das Zusammenführen den Lesern helfen?
Bei einem Ja auf die erste Frage liegt ein technisches Duplikat vor, und ein Canonical oder eine Weiterleitung löst es. Ein Ja auf die zweite Frage spricht für das Zusammenführen der Inhalte. Bei einem Ja auf die dritte Frage sollten Sie die Seiten ohnehin verbinden.
Warum entsteht Duplicate Content?
Duplicate Content entsteht meist aus technischen Gründen. Die Google Dokumentation nennt regionale Varianten, mobile und Desktop Versionen, HTTP gegenüber HTTPS, Sortier und Filterfunktionen sowie versehentlich erreichbare Testversionen.
In der Praxis ergänzen wir einige häufige Beispiele. Sitzungs IDs, Druckversionen und Tag Archive tauchen immer wieder auf. Zudem kursieren nach dem Sortieren oft lange URLs, die jemand teilt.
Außerdem können auch Inhalte Duplikate erzeugen. Typisch ist die Beschreibung eines Lieferanten, die Sie bei Hunderten Produkten übernehmen. Ebenso gehören Stadtseiten dazu, bei denen sich nur der Ortsname ändert.
Die Ursachen lassen sich in zwei Gruppen ordnen:
- Technische Ursachen: Versionen mit und ohne www, HTTP und HTTPS, Parameter, Paginierung, Schrägstrich am Ende, Testumgebungen.
- Inhaltliche Ursachen: Lieferantentexte, Vorlagenseiten, fast identische Orts und Leistungsseiten, Texte von anderen Websites.
Zunächst gilt: Eine einzige technische Einstellung kann Hunderte Seiten betreffen. Inhaltliche Ursachen verlangen dagegen Handarbeit Seite für Seite. Daher ist es effizienter, zuerst die technischen Punkte zu bereinigen.
Um zu erkennen, welcher Punkt bei Ihnen in welche Gruppe fällt, erstellen Sie ein URL Inventar. Dort setzen Sie jede Adresse neben ihren Statuscode, ihren Canonical Wert und ihre Position in der Sitemap. Denn Widersprüche fallen in dieser Tabelle sofort auf.
Erzeugen URL Parameter Duplicate Content?
Ja, sehr oft. Sortier, Filter, Tracking und Sitzungsparameter liefern denselben Inhalt unter verschiedenen Adressen. Auch wenn die Seite gleich bleibt, ändert sich die URL, deshalb sieht Google jede Variante als eigenen Kandidaten.
Zum Beispiel kann eine Kategorieseite eine Sortierung nach Preis anbieten. Die Produkte bleiben gleich, die Adresse ändert sich jedoch. Ebenso haben Tracking Codes in Werbekampagnen denselben Effekt. Mehr dazu finden Sie in unserem Beitrag zu URL Parametern und SEO.
Konkret setzen Sie hier drei Hebel ein. Erstens verweisen Sie mit einem Canonical auf die saubere Version ohne Parameter. Zweitens vermeiden Sie unnötige Parameter in internen Links. Drittens lassen Sie Parameter URLs aus der Sitemap heraus.
Für Tracking Parameter wie UTM Tags legen Sie zusätzlich eine eigene Regel fest. Markierte Adressen können in externen Links auftauchen, denn das ist normal. Ein Canonical bündelt deren Signale auf der sauberen URL.
Denken Sie daran: Das Ziel ist nicht, Parameter abzuschaffen. Vielmehr sollen Sie Google konsequent sagen, welche Version die Hauptversion ist.
Verursachen der Schrägstrich am URL Ende und www Duplicate Content?
Technisch gesehen ja. Liefern "/seite" und "/seite/" denselben Inhalt, existieren zwei getrennte URLs. Dasselbe gilt für www gegenüber ohne www sowie für HTTP gegenüber HTTPS.
Google löst solche Unterschiede zwar meist selbst. Trotzdem sollten Sie das Ergebnis bestimmen, statt es Google zu überlassen. Wählen Sie ein Format und leiten Sie alle anderen per 301 darauf um. Details zeigt unser Beitrag zum Schrägstrich am URL Ende.
Ihre Checkliste sollte so aussehen:
- Nutzen Sie für die ganze Website ein einziges Protokoll: HTTPS.
- Wählen Sie einen Hauptdomainnamen, mit oder ohne www.
- Wenden Sie die Regel zum Schrägstrich überall gleich an.
- Leiten Sie jedes alte Format in einem Schritt per 301 um.
- Verwenden Sie in internen Links nur Ihr gewähltes Format.
Weiterleitungen in einem Schritt sind wichtig. Denn Ketten kosten Ladezeit und können Signale verlieren. Wir erklären das in unserem Beitrag zur Weiterleitungskette.
Wann schadet Duplicate Content wirklich?
Duplicate Content schadet, wenn Google die falsche URL wählt, Linksignale sich aufteilen oder Crawl Budget verloren geht. Dabei ist ein einzelnes Duplikatpaar meist harmlos. Der Schaden wächst mit Umfang und Inkonsistenz.
Wir sehen drei konkrete Szenarien:
- Signalverlust: Externe Links auf eine Seite verteilen sich auf zwei URLs, und keine gewinnt genug Stärke.
- Falsche Version: Google wählt eine Parameter Adresse oder eine veraltete Version, und Nutzer landen auf einer schwachen Seite.
- Crawl Verschwendung: Tausende unnötige URLs fressen Ressourcen, daher entdeckt Google wichtige Seiten spät.
Auf kleinen Websites ist Crawl Verschwendung selten ein Problem. Bei großen Shops können Filterkombinationen dagegen Millionen URLs erzeugen. Dann wird es ernst.
Fragen Sie deshalb nicht "Habe ich Duplikate?". Fragen Sie stattdessen: "Wählt Google die falsche Version, und streuen meine Signale?" Lautet die Antwort auf die zweite Frage nein, besteht kein Zeitdruck.
Greifen Sie nicht pauschal ein, bevor Sie das geprüft haben. Denn ein falscher Canonical schafft ein neues Problem, statt das alte zu lösen.
Wie finden Sie Duplicate Content?
Der verlässlichste Startpunkt ist die Google Search Console. Im Bericht zur Seitenindexierung zeigen Status wie "Duplikat, vom Nutzer gewählte kanonische Seite weicht ab" und "Google hat eine andere kanonische Seite gewählt", wie Google Ihre Duplikate behandelt.
Wie Sie diesen Bericht lesen, erklärt unsere Anleitung zur Google Search Console. Zudem beschreiben wir die Gründe für fehlende Seiten im Beitrag nicht indexierte Seiten finden.
Die zweite Methode: Suchen Sie einen Satz Ihrer Seite in Anführungszeichen. Sehen Sie in den Ergebnissen mehrere URLs Ihrer eigenen Website oder fremde Domains, liegen Duplikate vor.
Die dritte Methode ist ein Website Crawl. Mit einem Crawler listen Sie Seiten mit gleichem Titel, gleicher Meta Description und gleichem Inhalt auf. Unser SEO Check hilft Ihnen bei den Grundprüfungen einer einzelnen Seite.
Schließlich prüfen Sie Ihre Sitemap. Enthält sie Parameter URLs oder weitergeleitete Adressen, ist das ein frühes Warnzeichen.
Was ist ein Canonical Tag und wie setzen Sie ihn ein?
Ein Canonical Tag teilt Google mit, welche Adresse Sie bevorzugen, wenn derselbe Inhalt unter mehreren URLs liegt. Dazu fügen Sie einen rel="canonical" Link in den Head der Seite ein, oder Sie senden ihn im HTTP Header.
Laut Google ist ein Canonical kein Befehl, sondern ein starker Hinweis. Google kann also eine andere URL wählen. Deshalb müssen Ihre übrigen Signale in dieselbe Richtung zeigen.
Für die richtige Anwendung beachten Sie diese Regeln:
- Schreiben Sie absolute URLs, keine relativen Pfade.
- Geben Sie auch der kanonischen Seite einen Tag, der auf sich selbst zeigt.
- Nutzen Sie in internen Links, Sitemap und Weiterleitungen dieselbe Adresse.
- Verweisen Sie niemals per Canonical auf eine Seite mit anderem Inhalt.
- Lassen Sie nicht zwei widersprüchliche Canonicals auf einer Seite stehen.
Um den Tag von Hand zu schreiben, nutzen Sie unseren Meta Tag Generator. Prüfen Sie nach dem Einbau immer im Quelltext, ob der Tag wirklich geladen wird.
Sollten Sie eine 301 Weiterleitung oder einen Canonical nutzen?
Nutzen Sie eine 301, wenn die alte URL Besuchern nicht mehr gezeigt werden muss. Setzen Sie einen Canonical ein, wenn beide Adressen erreichbar bleiben müssen. Denn Google beschreibt die dauerhafte Weiterleitung als stärkstes Signal für die Ziel URL.
Die folgende Tabelle stellt beide Methoden nebeneinander:
| Kriterium | 301 Weiterleitung | Canonical Tag |
|---|---|---|
| Signalstärke | Stärkstes Signal | Starker Hinweis, nicht bindend |
| Bleibt die alte URL offen? | Nein, Nutzer landen auf der neuen Adresse | Ja, beide Adressen bleiben offen |
| Typischer Einsatz | HTTP auf HTTPS, www Unterschied, verschobene Seite | Filter, Sortierung, Tracking Parameter |
| Risiko | Weiterleitungsketten | Verweis auf die falsche Seite |
| Umsetzung | Serverkonfiguration | HTML Head oder HTTP Header |
Daher wählen Sie bei Duplikaten, die Nutzer nie brauchen, die 301. Bei Varianten, die Nutzer brauchen, die Suche aber nicht zeigen soll, wählen Sie den Canonical.
Testen Sie Ihre Weiterleitungen mit unserem Redirect Checker. Auch Googles Leitfaden zum Zusammenführen doppelter URLs ordnet die Methoden nach Stärke.
Lösen Noindex und robots.txt das Problem mit Duplicate Content?
Nein, beide sind für Duplikate nicht das richtige Werkzeug. Deshalb rät Google davon ab, robots.txt zur Kanonisierung zu nutzen. Denn per robots.txt gesperrte URLs kann Google auch ohne Inhalt indexieren.
Noindex nimmt die Seite dagegen komplett aus der Suche, also auch mit allen Signalen. Wollen Sie Duplikate zusammenführen, verlieren Sie dann alle Signale, statt sie auf die Hauptseite zu übertragen.
Kurz gesagt hat jedes Werkzeug eine eigene Aufgabe:
- Robots.txt steuert das Crawling und entscheidet nicht über die Indexierung.
- Noindex nimmt eine Seite aus der Suche und überträgt keine Signale.
- Canonical und 301 bündeln Signale auf einer URL.
Eine Ausnahme gibt es: Bei Seiten ohne Wert, ohne eingehende Links und ohne Nutzen für Besucher kann Noindex sinnvoll sein. Zum Beispiel gehören Seiten mit internen Suchergebnissen dazu.
Mehr lesen Sie in unserem Beitrag zu häufigen robots.txt Fehlern. Regeln schreiben Sie sicher mit dem robots.txt Generator.
Wie gehen Sie mit Duplicate Content im E-Commerce um?
Im E-Commerce tritt Duplicate Content am häufigsten bei Filtern, Varianten und Lieferantentexten auf. Sie steuern ihn, indem Sie entscheiden, welche URLs in der Suche erscheinen sollen, und die übrigen per Canonical oder Weiterleitung daran binden.
Farb und Größenvarianten sind dafür ein typisches Beispiel. Bekommt jede Variante eine eigene URL, bleibt der Inhalt fast gleich. Meist genügt dann ein Canonical auf die Hauptproduktseite. Für Varianten mit eigener Suchnachfrage schreiben Sie dagegen eigenständige Inhalte.
Lieferantentexte sind die zweite große Quelle. Dieselbe Beschreibung steht auf Hunderten Websites. Beginnen Sie mit den meistverkauften und meistgesuchten Produkten, und schreiben Sie deren Beschreibungen zuerst neu. Dabei müssen Sie nicht alles auf einmal erledigen.
Zudem braucht auch die Paginierung Sorgfalt. Jede Seite der Paginierung sollte ihren eigenen Canonical behalten. Zeigen alle Seiten auf Seite eins, findet Google die tieferen Produkte somit nicht.
Zur Struktur lesen Sie unseren Leitfaden zu E-Commerce SEO für Produkt und Kategorieseiten. Möchten Sie den gesamten Prozess an uns geben, sehen Sie sich unsere E-Commerce Beratung an.
Wie vermeiden Sie Duplicate Content bei mehrsprachigen und regionalen Seiten?
Übersetzungen in andere Sprachen sind keine Duplikate. Regionale Varianten mit gleicher Sprache, etwa Deutsch für Deutschland und Österreich, können sich dagegen stark ähneln. Dann setzen Sie hreflang Tags und eine saubere Canonical Struktur gemeinsam ein.
Die Google Dokumentation empfiehlt bei regionalen Varianten beides: Kanonisierung und hreflang. Hreflang sagt Google, welche Sprach oder Regionalversion für wen gedacht ist. Ein Canonical stellt sicher, dass jede Version auf ihre eigene Adresse zeigt.
Der häufigste Fehler ist ein Canonical jeder Sprachversion auf die Seite der Hauptsprache. Dann können übersetzte Seiten aus dem Index fallen. Jede Sprachversion sollte daher auf sich selbst verweisen.
Bauen Sie eine mehrsprachige Website, ist unser Leitfaden zur mehrsprachigen Website SEO ein guter Start. Den Tag erklären wir in Was ist das hreflang Tag. Googles Dokumentation zu lokalisierten Versionen liefert die technischen Details.
Unsere eigene Website erscheint in drei Sprachen. Dabei nutzt jede Sprachversion hreflang zusammen mit ihrer eigenen Canonical Adresse.
Was tun Sie, wenn andere Websites Ihre Inhalte kopieren?
Bestätigen Sie zuerst, dass es wirklich eine Kopie ist, und kontaktieren Sie dann die kopierende Website. Löscht sie den Text nicht, können Sie sich an den Hosting Anbieter wenden oder rechtliche Wege prüfen. Allerdings erkennt Google die Originalquelle meist recht gut.
Anders sieht es bei der Syndizierung aus. Veröffentlichen Sie Ihren Inhalt bewusst auf einer anderen Website, bitten Sie dort um einen Canonical auf Ihre Originalseite. Ist das nicht möglich, fordern Sie zumindest einen sichtbaren Quellenlink zum Original.
Hilfreich ist es auch, zuerst auf der eigenen Website zu veröffentlichen und die Indexierung abzuwarten. Somit steigt die Chance, dass Google Sie als erste Quelle einstuft.
Der Kampf gegen Massen Scraper ist allerdings oft Zeitverschwendung. Produktiver ist es, Ihre Energie in originelle, aktuelle und starke Inhalte zu stecken. Schwache und wiederholende Seiten bereinigen Sie mit der Hilfe unseres Beitrags Content Pruning.
Also gilt: Bringen Sie zuerst Ihr eigenes Haus in Ordnung, und schauen Sie dann auf Kopien außerhalb.
Bedenken Sie außerdem, dass Kopiertwerden oft ein Zeichen für wertvolle Inhalte ist. Statt in Panik zu geraten, stärken Sie lieber die Signale, die Sie als Original ausweisen: regelmäßige Veröffentlichungen, eine starke interne Verlinkung und klare Autorenangaben.
Sind Duplicate Content und SEO Kannibalisierung dasselbe?
Nein, das ist nicht dasselbe. Duplicate Content bedeutet, dass derselbe Text unter mehreren URLs liegt. Kannibalisierung dagegen bedeutet, dass verschiedene Seiten um dieselbe Suchabsicht konkurrieren. Beides kann zusammen auftreten, die Lösungen unterscheiden sich jedoch.
Bei einem Duplikatpaar wählen Sie ein technisches Werkzeug: eine 301 oder einen Canonical. Bei Kannibalisierung treffen Sie dagegen eine inhaltliche Entscheidung. Sie führen Seiten zusammen, verschieben eine auf eine andere Suchabsicht oder vereinfachen eine davon.
Beantworten zum Beispiel zwei Beiträge die Frage "Was ist ein Canonical", liegt eine Überschneidung der Suchabsicht vor, keine Kopie. Google kann beide zeigen, aber dann erreicht keine Platz eins. Dann wählen Sie die stärkere Seite und übernehmen den Inhalt der anderen.
Zur Unterscheidung schauen Sie in der Search Console auf die Seitenverteilung je Suchanfrage. Wechseln sich zwei URLs bei einer Anfrage ab, vermuten Sie also Kannibalisierung. Vergleichen Sie danach die Texte. Sind sie verschieden, gibt es kein Duplikat, nur eine Überschneidung.
Diese Unterscheidung ist wichtig, denn eine falsche Diagnose führt zur falschen Medizin. Ein Canonical zwischen zwei Seiten ohne Duplikat kann dazu führen, dass eine davon aus der Suche verschwindet.
Erzeugen Paginierung, Tag und Archivseiten Duplicate Content?
Sie können es, sind aber dennoch meist harmlos. Paginierte Seiten listen unterschiedliche Produkte oder Beiträge, daher unterscheiden sich ihre Inhalte tatsächlich. Tag und Archivseiten wiederholen dagegen dieselben Beitragsauszüge und sind deshalb eine schwache Duplikatquelle.
In Blogs listen Kategorie, Tag, Autoren und Datumsarchive dieselben Beiträge. Sind alle für die Indexierung offen, sieht Google Dutzende Seiten voller gleicher Auszüge. Archive ohne Mehrwert zu schließen oder zusammenzuführen ist sinnvoll.
Wir empfehlen diesen Ansatz:
- Behalten Sie bei der Paginierung für jede Seite die eigene Canonical Adresse.
- Nehmen Sie Datums und Autorenarchive ohne Nutzen für Besucher aus dem Index.
- Halten Sie Tags wenige und sinnvoll; erzeugen Sie keine Tags für einen einzigen Beitrag.
- Ergänzen Sie Kategorieseiten um eine kurze, eigene Beschreibung.
Daher verringert diese Ordnung Duplikate und verbessert die Crawl Effizienz. Außerdem stärkt das Bereinigen schwacher Archive die Geschlossenheit Ihrer Inhalte.
Wie sieht eine Bereinigung von Duplicate Content in einem Onlineshop aus?
Das folgende Beispiel ist eine Beispielrechnung, frei erfunden, um die Logik zu zeigen. Es ist also kein echtes Kundenergebnis. Ziel ist es, die Priorisierung nachvollziehbar zu machen.
Angenommen, ein Shop hat 2.000 Produkte. Durch Filter und Sortierparameter ist die Zahl crawlbarer URLs auf 12.000 gestiegen. Außerdem enthält die Sitemap 1.500 Parameter Adressen.
| Schritt | Problem (Beispielrechnung) | Lösung |
|---|---|---|
| 1 | HTTP und Versionen ohne www sind offen | 301 in einem Schritt auf HTTPS und einen Hostnamen |
| 2 | Gefilterte URLs auf 12.000 angewachsen | Canonical auf die saubere Version, unnötige interne Links stoppen |
| 3 | 1.500 Parameter Adressen in der Sitemap | Sitemap nur mit Standard URLs neu erzeugen |
| 4 | Lieferantentext bei 300 Produkten identisch | Neu schreiben, beginnend mit den 50 Bestsellern |
In diesem Beispiel enden die ersten drei Schritte in einem technischen Sprint. Der vierte Schritt zieht sich dagegen über Wochen, denn er braucht Handarbeit. Also schließen Sie zuerst die technische Arbeit ab und erneuern die Inhalte stufenweise.
Wie lange dauert es, bis die Bereinigung von Duplicate Content wirkt?
Eine genaue Dauer können wir nicht nennen. Google muss Ihre Änderungen erneut crawlen und die Cluster neu bewerten. Das dauert je nach Größe und Crawl Häufigkeit Tage oder Wochen. Deshalb versprechen wir keine Ergebnisse.
Konkret beschleunigen einige Dinge das Resultat. Wird Ihre Website oft gecrawlt, bemerkt Google Änderungen schnell. Sind Ihre Signale konsistent, steht die Entscheidung früher fest. Laufen Weiterleitungen in einem Schritt, verläuft der Prozess sauberer.
Dann brauchen Sie vor allem Geduld. Wenige Tage nach der Änderung sehen Sie im Indexbericht womöglich noch keine Bewegung. Beobachten Sie wöchentlich weiter, und reagieren Sie nicht auf kurzfristige Schwankungen.
Eine Warnung noch: Rankings hängen nicht allein von Duplikaten ab. Wächst der Traffic nach dieser Arbeit nicht, suchen Sie die Ursache woanders. Schwankungen deuten Sie mit unserem Beitrag zu Ranking Schwankungen.
Wie sieht ein Plan Schritt für Schritt zur Bereinigung aus?
Der Plan besteht aus sechs Schritten, die vom Kleinen zum Großen führen. Zunächst schließen Sie technische Duplikate einzeln, dann gehen Sie zu inhaltlichen über. Halten Sie die Reihenfolge ein, zahlt sich die Arbeit schnell aus.
- Exportieren Sie Duplikat und Canonical Status aus der Search Console.
- Legen Sie Protokoll, Hostnamen und Schrägstrich Regeln per 301 fest.
- Richten Sie Canonicals und interne Links für Parameter URLs ein.
- Aktualisieren Sie die Sitemap nur mit Standard URLs.
- Schreiben Sie Lieferanten und Vorlagentexte nach Wichtigkeit neu.
- Führen Sie sehr ähnliche Seiten zusammen und leiten Sie die alten weiter.
Prüfen Sie zudem das Ergebnis nach jedem Schritt. Eine einzige falsche Weiterleitungsregel kann Hunderte Seiten beschädigen. Testen Sie Änderungen daher zuerst in einem kleinen Bereich.
Bei Umzügen und Relaunches steigt das Duplikatrisiko. Denn alte und neue URLs existieren eine Zeit lang nebeneinander. Sehen Sie sich deshalb vorab unsere Checkliste zur Website Migration an.
Planen Sie eine neue URL Struktur, erzeugen Sie mit dem XML Sitemap Generator eine saubere Karte.
Welche Fehler passieren bei der Bereinigung von Duplicate Content am häufigsten?
Der häufigste Fehler ist ein pauschaler, unkontrollierter Einsatz von Canonicals. Der zweite ist, Duplikat URLs in der robots.txt zu sperren und das Problem für gelöst zu halten. Beide Fehler sehen wir trotzdem auf vielen Websites.
Weitere verbreitete Fehler sind:
- Der Canonical jeder Seite zeigt auf die Startseite.
- Die Ziel URL eines Canonicals leiten Sie weiter oder setzen auf Noindex.
- Die Sitemap enthält Adressen, die nicht kanonisch sind.
- Interne Links mischen verschiedene URL Formate.
- Übersetzte Seiten gelten als Duplikate und zeigen auf die Hauptsprache.
Diesen Fehlern ist eines gemeinsam: widersprüchliche Signale. Sagen Sie an einer Stelle "Diese Adresse ist die Hauptversion" und an anderer "Nein, jene ist es", liegt die Entscheidung nicht mehr bei Ihnen.
Prüfen Sie daher nach jeder Änderung alle Signale zusammen: Canonical, Weiterleitung, Sitemap, interne Links und hreflang. Alle sollten also auf dieselbe Adresse zeigen.
Einen breiteren Überblick über solche Fehler bieten unsere Tipps zum technischen SEO.
Wie überwachen Sie Probleme mit Duplicate Content?
Eine monatliche Routine genügt. Prüfen Sie jeden Monat in derselben Reihenfolge den Indexbericht der Search Console, die URL Anzahl der Sitemap und die Crawl Statistiken. Denn plötzliche Ausschläge sind das erste Zeichen für Ärger.
Diese Indikatoren deuten auf ein Problem hin:
- Ein plötzlicher Anstieg von URLs mit dem Status "Alternative Seite mit richtigem kanonischen Tag", den Sie nicht geplant haben.
- Mehr Seiten, die gecrawlt, aber nicht indexiert sind.
- Zwei verschiedene URLs Ihrer Website wechseln sich bei derselben Suchanfrage ab.
- Ein Sprung der URL Anzahl nach dem Hinzufügen eines neuen Filters oder Parametertyps.
Wächst die Website, lohnt es sich, diese Kontrolle zu automatisieren. Fragen Sie vor dem Start einer neuen Funktion, ob sie die URL Erzeugung verändert. Sprechen Entwickler und SEO Verantwortliche früh darüber, vermeiden sie viele Probleme.
Suchen Sie nach den Gründen für Einbrüche, hilft Ihnen auch unser Beitrag zum Traffic Einbruch in der Search Console.
Wie arbeiten wir bei Duplicate Content mit Kunden zusammen?
Als Team führen wir zunächst einen technischen Crawl durch und ordnen die Duplikat Cluster dann nach Wirkung. Wir trennen, was tatsächlich Traffic kostet, und greifen nur dort ein. Dadurch erzeugen wir keine unnötige Arbeit.
Der Prozess hat also meist drei Phasen. Zunächst prüfen wir in der Analyse Daten der Search Console und das Crawl Ergebnis. Danach entscheiden wir in der Planung für jeden Cluster zwischen 301, Canonical und Zusammenführung. Schließlich geben wir in der Umsetzung Änderungen schrittweise frei und beobachten das Ergebnis.
Ergebnisse garantieren wir allerdings nicht. Rankings hängen nicht allein von Duplikaten ab. Dennoch ist eine saubere URL Struktur die Grundlage für alle weiteren SEO Arbeiten.
Wünschen Sie eine solche Einschätzung für Ihre Website, erreichen Sie uns über unsere Seite zur SEO Beratung. Ist Ihnen auch die Sichtbarkeit in der KI Suche wichtig, sehen Sie sich unsere Leistung KI SEO und GEO an.
Eine saubere Struktur hilft sowohl Google als auch KI Systemen, Ihre Website richtig zu verstehen.




