Duplicate Content

Unklar, welche deiner Seiten Google überhaupt nimmt?

Wir sehen nach, welche URLs als Duplikate behandelt werden, woher die Varianten kommen und mit welchem Mittel sie sich am saubersten zusammenführen lassen.

Duplicate Content bezeichnet identische oder weitgehend übereinstimmende Inhalte, die unter mehreren URLs erreichbar sind — innerhalb einer Website oder über mehrere Domains hinweg. Das Problem ist in der Regel keine Bestrafung, sondern Verwässerung: Suchmaschinen wählen eine Fassung aus, die Bewertung verteilt sich auf mehrere Adressen, und welche Seite erscheint, wird unvorhersehbar.

Kurz zusammengefasst:

  • Es gibt keine „Duplicate-Content-Strafe“ — das ist ein hartnäckiger Mythos.
  • Der Schaden ist Verwässerung und Kontrollverlust, nicht eine Abwertung.
  • Die meisten Fälle entstehen ungewollt und technisch.
  • Standardmittel: Canonical Tag, 301-Weiterleitung, noindex — je nach Fall.
  • Bei KI-Antworten wirkt sich Uneindeutigkeit ähnlich aus: Was mehrfach dasteht, wird seltener eindeutig zitiert.

Der Mythos von der Strafe

Die Vorstellung, Google bestrafe doppelte Inhalte, hält sich seit Jahren. Sie ist falsch. Eine manuelle Maßnahme droht nur, wenn massenhaft fremde Inhalte kopiert werden, um Suchergebnisse zu manipulieren. Der Normalfall — zwei Adressen für denselben Text — führt schlicht dazu, dass eine Fassung ausgewählt und die andere aussortiert wird.

Trotzdem ist der Zustand unerwünscht: Man verliert die Kontrolle darüber, welche Seite rankt, Verlinkungen verteilen sich auf mehrere Adressen, und das Crawl-Budget geht für Wiederholungen drauf.

Wie es entsteht

UrsacheBeispielLösung
URL-Variantenmit/ohne www, http/https, mit/ohne Schrägstrich301-Weiterleitung auf eine Fassung
ParameterFilter, Sortierung, KampagnenkennungenCanonical auf die saubere URL
ArchiveKategorie, Schlagwort, Autor, Datum mit gleichem AuszugAuswahl treffen, Rest auf noindex
SeitennummerierungSeite 2, 3, 4 einer Übersichteigenständige Fassungen, jeweils Canonical auf sich selbst
Ähnliche Leistungsseitenje eine Seite pro Stadt mit identischem Textzusammenlegen oder echte Unterschiede schaffen
Übernommene TexteHerstellerbeschreibungen, Pressemitteilungeneigenen Text ergänzen
Entwicklungsumgebung onlineTestsystem ist öffentlich erreichbarPasswortschutz

Der letzte Punkt ist unterschätzt: Ein frei erreichbares Testsystem verdoppelt die komplette Website. Er begegnet uns bei Übernahmen von Projekten regelmäßig.

Der Sonderfall: Städteseiten

Ein Muster, das im lokalen Umfeld ständig auftaucht: zwanzig Seiten nach dem Schema „Leistung in Stadt X“, bei denen nur der Ortsname ausgetauscht ist. Suchmaschinen erkennen das zuverlässig. Das Ergebnis ist meist, dass eine Seite indexiert wird und die übrigen als Duplikate gelten — der Aufwand verpufft.

Solche Seiten funktionieren nur, wenn sie tatsächlich etwas Eigenes bieten: Referenzen aus dem Ort, konkrete Anfahrt und Erreichbarkeit, lokale Besonderheiten, echte Fallbeispiele. Wenn sich nichts Eigenes sagen lässt, ist eine gute Seite besser als zwanzig ähnliche.

Innerhalb der Website oder über Domains hinweg

Intern entstehen Duplikate fast immer technisch und lassen sich mit Canonical, Weiterleitung und noindex sauber lösen.

Extern — wenn andere Websites deine Inhalte übernehmen — ist die Lage unangenehmer. Bei erlaubter Übernahme sollte die andere Seite ein Canonical auf dein Original setzen. Bei unerlaubter Übernahme bleiben der Hinweis an den Betreiber, eine urheberrechtliche Abmahnung oder eine Beschwerde beim Suchmaschinenbetreiber. In der Praxis gewinnt meist die Seite, die den Inhalt zuerst veröffentlicht hat und die stärkere Domain besitzt — was nicht immer die eigene ist.

Erkennen

  • Search Console, Bericht „Seitenindexierung“: Einträge wie „Duplikat – Google hat andere Seite gewählt“ oder „Alternative Seite mit richtigem kanonischen Tag“.
  • Stichprobe in der Suche: einen markanten Satz in Anführungszeichen suchen. Erscheinen mehrere eigene URLs, gibt es intern ein Problem; erscheinen fremde, wurde übernommen.
  • Crawler-Werkzeuge, die identische Titel und Beschreibungen auflisten — ein zuverlässiger Frühindikator.

Wirkung auf KI-Antworten

Für zitierende KI-Systeme gilt Ähnliches wie für die klassische Suche, nur schärfer: Uneindeutige Quellen werden seltener herangezogen. Wenn derselbe Sachverhalt bei dir an vier Stellen leicht unterschiedlich steht, ist keine dieser Stellen eine klare Referenz. Eine konsolidierte, ausführliche Seite wird eher zitiert als vier halbe — siehe GEO.

Häufige Fragen

Bestraft Google doppelte Inhalte?

Nein. Es gibt keine allgemeine Strafe für Duplicate Content. Suchmaschinen wählen eine Fassung aus und ignorieren die übrigen. Manuelle Maßnahmen drohen nur bei massenhaft kopierten Fremdinhalten mit Manipulationsabsicht.

Ist es schlimm, wenn meine Seite mit und ohne www erreichbar ist?

Es sollte behoben werden, ist aber leicht zu lösen: eine Fassung festlegen und die andere per 301 weiterleiten. Zusätzlich sollten interne Links und die Sitemap dieselbe Fassung verwenden.

Wie viel Übereinstimmung ist ein Problem?

Es gibt keinen festen Schwellenwert. Entscheidend ist, ob sich die Seiten aus Nutzersicht sinnvoll unterscheiden. Zwei Texte mit ausgetauschtem Ortsnamen tun das nicht, zwei Artikel zum selben Thema mit unterschiedlichem Blickwinkel schon.

Was tun, wenn jemand meine Texte kopiert?

Zuerst dokumentieren — Bildschirmfoto mit Datum. Dann den Betreiber auffordern, den Inhalt zu entfernen oder ein Canonical auf dein Original zu setzen. Bleibt das erfolglos, kommen urheberrechtliche Schritte oder eine Beschwerde beim Suchmaschinenbetreiber in Betracht.

Sind Kategorie- und Schlagwortseiten Duplicate Content?

Sie können es werden, wenn sie dieselben Beiträge mit denselben Auszügen listen. Üblich ist, eine Archivart als indexierbar zu behalten — meist die Kategorien — und die übrigen auf noindex zu setzen.

Hilft ein Canonical immer?

Nur, wenn die Inhalte tatsächlich weitgehend übereinstimmen und die übrigen Signale nicht widersprechen. Zwei inhaltlich verschiedene Seiten lassen sich damit nicht zusammenlegen — die Angabe wird dann ignoriert.

Der Autor: Tim Ehling

Über den Autor

Tim Ehling

Seit über zwei Jahrzehnten beschäftige ich mich mit Webentwicklung – und seit 2006 ganz besonders intensiv mit WordPress. Ich entwickle und optimiere Webseiten, betreue sie langfristig durch zuverlässige Wartung und biete Schulungen für alle, die WordPress sicher und effizient nutzen möchten. Außerdem unterstütze ich Unternehmen dabei, ihre Social-Media-Kanäle und SEO-Strategien so zu verbessern, dass sie bei Kunden und Suchmaschinen gleichermaßen gut ankommen.

Mehr aus dem Glossar