Duplicate Content finden und beheben Der vollständige Guide

Duplicate Content in WordPress finden und beheben

In Kürze: Duplicate Content sind gleiche oder sehr ähnliche Inhalte unter mehreren URLs – in WordPress meist durch Kategorie- und Tag-Seiten, Paginierung, URL-Parameter oder www-Varianten. Eine Strafe gibt es dafür nicht: Google wählt einfach eine Version als kanonisch und filtert den Rest. Am schnellsten findest du Duplikate im Seitenindexierung-Bericht der Search Console. Behoben wird das per Canonical-Tag oder 301.

Was ist Duplicate Content wirklich?

Duplicate Content ist derselbe oder ein fast identischer Inhalt, der unter mehreren URLs erreichbar ist. Wichtig – und anders, als der SEO-Mythos behauptet: Es gibt keine Duplicate-Content-Strafe.

Google-Sprecher John Mueller hat mehrfach bestätigt, dass es keine Penalty für Duplicate Content gibt, und auch die Search-Central-Dokumentation sagt das klar: Duplikate sind nur ein Problem, wenn dahinter eine Täuschungsabsicht steckt, etwa Scraping.

Was wirklich passiert: Google clustert die Duplikate, wählt eine Version als kanonisch und filtert den Rest aus den Ergebnissen. Die echten Kosten sind mechanisch – verwässerte Signale, Indexierungs-Verwirrung und verschwendetes Crawl-Budget. Genau das behebst du hier.

Die 5 häufigsten Ursachen in WordPress

In WordPress entsteht Duplicate Content selten durch kopierte Texte, sondern durch die URL-Struktur. Das sind die fünf typischen Auslöser:

  • Kategorie- und Tag-Archive: Derselbe Beitrag erscheint unter /category/xyz/ und /tag/xyz/ – oft mit dem vollen Text statt nur einem Anriss.
  • Paginierung: /page/2/ oder ?paged=2 erzeugen Archivseiten mit überlappenden Inhalten.
  • URL-Parameter: ?utm_source=, ?ref=, Filter oder Session-IDs erzeugen viele URLs mit identischem Inhalt.
  • www vs. non-www und HTTP vs. HTTPS: Ist die Seite unter allen vier Varianten erreichbar, sieht Google vier Versionen.
  • Trailing-Slash- und Anhang-Dubletten: /beitrag und /beitrag/ oder eigene Attachment-Seiten für jedes Bild.

Die Domain-Varianten löst du am saubersten per Weiterleitung – so erzwingst du eine kanonische Version schon auf Server-Ebene:

# In der .htaccess: auf HTTPS und www erzwingen
RewriteEngine On
RewriteCond %{HTTPS} off
RewriteRule ^(.*)$ https://%{HTTP_HOST}%{REQUEST_URI} [L,R=301]
RewriteCond %{HTTP_HOST} !^www\. [NC]
RewriteRule ^(.*)$ https://www.%{HTTP_HOST}/$1 [R=301,L]

Duplicate Content finden – 3 Tools im Praxis-Test

Du findest Duplikate am schnellsten mit einer Kombination aus dem GSC-Bericht (was Google real wertet) und einem Struktur-Scan. Die drei wichtigsten Werkzeuge:

ToolFindetKostenAm besten für
Search Console (Seitenindexierung)was Google tatsächlich als Duplikat behandeltkostenlosdie maßgebliche Quelle
Sitelinerinterne Duplikate auf der eigenen Domainkostenlos bis 250 Seitenschneller Struktur-Check
Copyscapeexterne Kopien und Plagiate deiner Textekostenpflichtig pro Suchegeklaute Inhalte aufspüren

So liest du den GSC-Bericht (früher „Coverage“):

  1. Öffne Search Console → Indexierung → Seiten.
  2. Scroll zu „Warum Seiten nicht indexiert werden“.
  3. Klick auf „Duplikat – vom Nutzer nicht als kanonisch festgelegt“ oder „Duplikat – Google hat eine andere Seite als kanonisch ausgewählt“.
  4. Exportier die Liste und sortier nach Typ: Parameter, Paginierung, echte Dubletten.

Für den Struktur-Check gibst du bei Siteliner nur deine Domain ein und liest den Duplicate-Content-Anteil aus. Copyscape brauchst du nur bei Verdacht auf geklaute Texte.

Duplicate Content beheben mit Canonical-Tags

Ein Canonical-Tag sagt Google, welche URL die maßgebliche Version ist. So sieht er im <head> aus:

<link rel="canonical" href="https://deine-domain.de/dein-beitrag/" />

Die gute Nachricht: Rank Math setzt auf jeder Seite automatisch einen selbstreferenzierenden Canonical. Eingreifen musst du nur bei Ausnahmen:

  1. Öffne den Beitrag im Editor und geh zur Rank-Math-Metabox → Tab „Advanced“.
  2. Trag im Feld „Canonical URL“ die gewünschte Ziel-URL ein (absolute URL, exakt die finale Adresse).
  3. Für duplizierende Tag-Archive: Rank Math SEO → Titles & Meta → Tags auf „noindex“ setzen, wenn sie keinen eigenen Wert haben.

Drei Regeln: ein Canonical pro Seite, niemals auf eine weitergeleitete oder noindex-Seite zeigen, und die URL muss exakt der finalen Adresse entsprechen. Tiefer dazu, wie du mit dem Canonical-Tag Duplicate Content vermeidest, ohne Inhalte zu löschen.

Wann ein 301 Redirect die bessere Lösung ist

Ein Canonical ist ein Vorschlag, den Google auch ignorieren kann. Ein 301 ist eine Anweisung. Nimm den 301, wenn die doppelte URL gar nicht erreichbar bleiben soll:

SituationLösung
Beide URLs bleiben erreichbar, eine soll bevorzugt indexiert werdenCanonical-Tag
Alte URL soll dauerhaft weg, Signale bündeln301 Redirect
Seite soll gar nicht in den Index (z. B. reine Tag-Archive)noindex

Klassischer Fall für den 301: zwei dünne Beiträge, die du zu einem starken zusammenlegst. Wie du das sauber umsetzt, steht in der Anleitung zur 301-Weiterleitung.

Case Study: mein Canonical-Problem im Juni 2026

Ein reales Beispiel aus dem eigenen Portfolio: Bei seitenbestand.de wählte Google im Juni für einen Blog-Post plötzlich die Homepage als kanonische Seite. Der Beitrag rankte kurz auf Seite 1 – und verschwand dann faktisch aus dem Index, obwohl inhaltlich nichts fehlte.

Die Diagnose lief über den Seitenindexierung-Bericht: Der Post stand dort als Duplikat mit von Google abweichend gewähltem Canonical. Ursache war eine Mischung aus schwachem Selbstbezug und internen Signalen, die zu stark auf die Startseite zeigten.

Die Lösung in drei Schritten: sauberes selbstreferenzierendes Canonical auf dem Beitrag, interne Links direkt auf die finale Post-URL statt auf die Startseite, und anschließend eine Neuindexierung angefordert. Wie sich so ein Fall bei der KI-Sichtbarkeit auswirkt, zeigt der Artikel, warum manche Websites im AI Overview zitiert werden und andere nie.

Häufige Fragen zu Duplicate Content

Was ist Duplicate Content?

Duplicate Content ist derselbe oder ein sehr ähnlicher Inhalt, der unter mehreren URLs erreichbar ist. In WordPress entsteht er meist technisch – durch Kategorie- und Tag-Seiten, Paginierung, URL-Parameter oder www-Varianten. Es geht also selten um kopierte Texte, sondern um doppelte Adressen für denselben Inhalt.

Bestraft Google Duplicate Content?

Nein. Google-Sprecher John Mueller und die Search-Central-Dokumentation bestätigen, dass es keine Duplicate-Content-Strafe gibt. Google wählt einfach eine Version als kanonisch und filtert die anderen aus den Ergebnissen. Ein Problem wird es nur bei Täuschungsabsicht wie Scraping.

Wie finde ich Duplicate Content in WordPress?

Am zuverlässigsten über den Seitenindexierung-Bericht der Search Console unter Indexierung, Seiten. Dort findest du Status wie „Duplikat – vom Nutzer nicht als kanonisch festgelegt“. Für einen schnellen Struktur-Scan der eigenen Domain nutzt du Siteliner, für geklaute Texte Copyscape.

Was ist der Unterschied zwischen Canonical-Tag und 301 bei Duplicate Content?

Ein Canonical-Tag ist ein Vorschlag: Beide URLs bleiben erreichbar, aber Google soll eine bevorzugt indexieren. Ein 301 ist eine Anweisung: Die alte URL wird dauerhaft auf die neue umgeleitet und ist nicht mehr erreichbar. Canonical nutzt du für Varianten, 301 fürs endgültige Zusammenlegen.

Wie setze ich einen Canonical-Tag mit Rank Math?

Rank Math setzt automatisch einen selbstreferenzierenden Canonical. Für Ausnahmen öffnest du die Rank-Math-Metabox im Beitrag, gehst auf den Tab „Advanced“ und trägst im Feld „Canonical URL“ die gewünschte absolute Ziel-URL ein. Achte darauf, dass sie exakt der finalen Adresse entspricht und nicht auf eine weitergeleitete Seite zeigt.

Sind Kategorie- und Tag-Seiten Duplicate Content?

Sie können es sein, wenn sie denselben vollen Beitragstext zeigen. Oft reicht es, Tag-Archive auf „noindex“ zu setzen, wenn sie keinen eigenen Mehrwert bieten, oder die Archive auf Anrisse statt Volltext umzustellen. Kategorien behältst du meist indexierbar, weil sie thematische Einstiegsseiten sind.

Was bedeutet „Duplikat – vom Nutzer nicht als kanonisch festgelegt“ in der Search Console?

Dieser Status bedeutet, dass Google mehrere sehr ähnliche URLs gefunden hat, du aber keine bevorzugte Version per Canonical festgelegt hast. Google wählt dann selbst eine – und indexiert die anderen nicht. Du behebst das, indem du auf jeder betroffenen Seite ein eindeutiges Canonical setzt.

Prüf deine Seiten

Du willst wissen, ob Duplikate deine wichtigsten Seiten ausbremsen? Der kostenlose AEO-Check von Seitenbestand prüft Struktur, Canonicals und Indexierbarkeit deiner Seite in unter einer Minute – ohne Login. So siehst du schwarz auf weiß, wo Google die falsche Version bevorzugt.