Duplicate Content: richtig prüfen und dauerhaft behoben halten
Um eine Website auf Duplicate Content zu prüfen, suchst du dieselbe Seite unter mehreren URLs: Parameter, http und https, www und nackte Domain, Pagination, Druckversionen, eine Staging-Domain, die indexierbar geblieben ist. Ein Crawler findet die Kopien, das Canonical-Tag entscheidet, welche Version zählt. Google bestraft Duplicate Content nicht, es wählt eine URL und ignoriert den Rest, was völlig in Ordnung ist, bis die falsche gewählt wird. Deltio vergleicht keine Seitentexte, sondern überwacht das Canonical auf jeder URL und meldet, wenn es fehlt, ungültig wird, doppelt auftaucht oder sich still verändert. Ab £20 pro Monat, mit 14 Tagen kostenloser Testphase.
Duplicate Content ist selten ein Textproblem. Auf einer Kundenwebsite ist es ein Architekturproblem: CMS, Shop, Filter oder eine Migration haben mehrere Adressen für dieselbe Seite erzeugt, und niemand hat den Suchmaschinen gesagt, welche bleiben soll. Das Audit findet es einmal. Es dauerhaft behoben zu halten, ist der schwierigere Teil.
Was zählt und was nicht
Eine Strafe für Duplicate Content gibt es nicht. Bei nahezu identischen Seiten konsolidieren Suchmaschinen: eine URL wird indexiert, die anderen fallen aus den Ergebnissen, und die Signale werden auf der gewählten gebündelt. Der Preis ist indirekt, aber real: du verlierst die Kontrolle darüber, welche URL rankt, interne Links und Backlinks verteilen sich auf mehrere Versionen, und das Crawl-Budget fließt in Kopien. Wiederverwendeter Boilerplate, kurze Produkttexte und eine Rechtsseite nach Vorlage sind nicht gemeint.
Woher die Kopien wirklich kommen
- URL-Varianten.
httpundhttps,wwwund nackte Domain, mit und ohne abschließenden Slash, Groß- und Kleinschreibung im Pfad. - Parameter. Tracking-Parameter, Session-IDs, Sortierungen und Filter auf Kategorieseiten.
- Facettennavigation und Pagination. Jede Filterkombination, die eine indexierbare URL erzeugt: die E-Commerce-Variante des Problems.
- Staging und Zweitdomains. Eine Testdomain, die nie gesperrt wurde, oder eine alte Domain, die nach der Migration weiter Inhalte ausliefert.
- Syndication und Druckansichten. Derselbe Artikel woanders erneut veröffentlicht, oder eine Druckkopie unter eigener URL.
Wie du sie findest
Fang mit einem Crawl an. Screaming Frog, Sitebulb oder jeder Crawler, der doppelte Titles, doppelte Meta Descriptions und Seiten mit gleichem Canonical meldet, bringt das meiste ans Licht. Danach die Search Console: der Seiten-Bericht markiert "Duplikat, ohne vom Nutzer ausgewähltes Canonical" und "Alternative Seite mit richtigem Canonical-Tag", also das, was Google tatsächlich gewählt hat. Eine site:-Suche nach einem markanten Satz findet den Rest. Wenn du für eine bestimmte Adresse prüfen willst, was im Index steht: hier steht, wie du prüfst, ob eine Seite indexiert ist.
Beheben: der Hebel ist das Canonical
- Selbstreferenzierendes Canonical auf jeder Seite. Absolute URL, eines pro Seite, identisch mit der Version, die indexiert werden soll.
- 301 dort, wo das Duplikat keinen Grund hat zu existieren. Alte Domains,
wwwauf die nackte Domain oder umgekehrt, alte URL-Muster. - Konsistenz der Signale. Canonical, Sitemap-Eintrag, interne Links und hreflang-Verweise sollten auf dieselbe Version zeigen. Ein Canonical, das der Sitemap widerspricht, ist ein Vorschlag, den Suchmaschinen ignorieren dürfen.
noindexnur für Seiten, die existieren, aber nicht ranken sollen. Interne Suchergebnisse, dünne Filterkombinationen.
Der Teil, den alle vergessen
Das Canonical ist eine Zeile im Head und damit das, was ein Deploy am leichtesten kaputt macht. Ein Template-Refactor entfernt es, ein Plugin-Update macht es relativ, ein Staging-Build richtet alle Canonicals auf die Testdomain. Nichts davon sieht man im Browser, nichts davon erzeugt ein Ticket. Deshalb hält ein Canonical-Audit bis zum nächsten Release. Das größere Muster steht in unserem Beitrag zum Website Code Change Monitoring.
Wie Deltio das macht
Deltio vergleicht keine Seitentexte und wird dir daher nicht sagen, dass zwei Artikel zu 80% ähnlich sind: dafür brauchst du einen Crawler oder ein Ähnlichkeitstool. Was es tut, ist das Tag zu überwachen, das über das Ergebnis entscheidet. Der SEO-Scanner prüft das Canonical auf jeder URL und meldet es als fehlend, ungültig oder mehrfach vorhanden, und er vergleicht aufeinanderfolgende Scans: ein Canonical, das seinen Wert ändert, wird als Änderung gemeldet, statt unauffällig dazustehen. Derselbe Scan deckt Title, Meta Description, H1, lang und hreflang ab, also die Stelle, an der sich nahezu identische Seiten zuerst als doppelte Titles zeigen. Sitemap-Snapshots laufen täglich und zeigen hinzugefügte oder entfernte URLs. Alerts kommen per E-Mail und Slack. Wie die Prüfung auf einer einzelnen Seite funktioniert, steht im Canonical-Tag-Checker.
Sorge dafür, dass die Korrektur hält
Duplikate zu beheben ist ein Projekt. Sie behoben zu halten ist Monitoring. Nimm die Website auf, aktiviere die Canonical-Alerts, und wenn ein Release sie das nächste Mal überschreibt, weißt du es am selben Tag statt beim nächsten Audit. Die 14 Tage kostenlose Testphase reichen, um den ersten Scan-Vergleich zu sehen.
Häufige Fragen
- Führt Duplicate Content zu einer Google-Strafe?
- Nein. Suchmaschinen konsolidieren, statt zu bestrafen: eine URL wird indexiert, die anderen fallen aus den Ergebnissen, die Signale werden auf der gewählten Version gebündelt. Der Schaden ist, dass du die Kontrolle darüber verlierst, welche URL rankt, und dass sich Links auf Kopien verteilen.
- Wie prüfe ich eine Website am schnellsten auf Duplicate Content?
- Crawle die Website und schau auf doppelte Titles, doppelte Meta Descriptions und Seiten mit gleichem Canonical. Vergleiche das anschließend mit dem Seiten-Bericht der Search Console, der zeigt, welche URL Google tatsächlich als Canonical gewählt hat.
- Wann Canonical und wann 301-Weiterleitung?
- Nimm eine 301, wenn die doppelte URL keinen Grund hat zu existieren, etwa eine alte Domain oder eine www-Variante. Nimm ein Canonical, wenn beide URLs erreichbar bleiben müssen, etwa eine gefilterte oder parametrisierte Version einer Kategorieseite.
- Vergleicht Deltio Seitentexte, um Duplikate zu finden?
- Nein. Deltio führt keinen Ähnlichkeitsvergleich von Inhalten durch. Es prüft das Canonical-Tag auf jeder URL und meldet es als fehlend, ungültig oder doppelt, und es meldet, wenn sich der Wert zwischen zwei Scans ändert, was nach einem Deploy typischerweise passiert.
- Warnt mich Deltio, wenn sich ein Canonical-Tag ändert?
- Ja. Der SEO-Scanner vergleicht aufeinanderfolgende Scans, ein Canonical, das sich ändert, verschwindet oder doppelt auftaucht, wird als Änderung gemeldet. Die Alerts kommen per E-Mail und Slack, in deiner Sprache.
- Was kostet Deltio?
- Starter kostet £24 pro Monat, im Jahresabo £20 pro Monat. Professional kostet £49 pro Monat, Enterprise £119 pro Monat. Alle Pläne enthalten 14 Tage kostenlose Testphase.