Duplicate Content
Duplicate Content bezeichnet identische oder stark ähnliche Inhalte, die unter mehreren unterschiedlichen URLs erreichbar sind.
Kurz erklärt
Duplicate Content entsteht häufig nicht durch bewussten Betrug, sondern durch technische Nebeneffekte: dieselbe Seite erreichbar mit und ohne www, mit und ohne abschließenden Schrägstrich, über mehrere Sortier- oder Filterparameter, oder als druckfreundliche Variante derselben Inhalte. Aus Sicht einer Suchmaschine sind das potenziell mehrere eigenständige Seiten mit identischem Inhalt.
Beispiel
Ein Online-Shop erzeugt für ein Produkt mehrere URLs durch Filterkombinationen wie /schuhe?farbe=schwarz und /schuhe?farbe=schwarz&sortierung=preis, obwohl der eigentliche Seiteninhalt weitgehend identisch bleibt. Ohne technische Steuerung sieht eine Suchmaschine hier mehrere separate, sich stark ähnelnde Seiten.
Warum ist das relevant?
Duplicate Content verwässert Rankingsignale, da sich Backlinks und Relevanzsignale auf mehrere URLs statt auf eine einzige, maßgebliche URL verteilen können. Zudem verschwenden Suchmaschinen Crawl-Budget auf redundante Varianten, statt es auf einzigartige Inhalte zu konzentrieren. Die gängigen technischen Lösungen sind Canonical Tags, konsistente interne Verlinkung und, wo sinnvoll, 301-Redirects auf eine einzige bevorzugte URL-Version.
Häufige Missverständnisse
Duplicate Content führt entgegen einer verbreiteten Annahme nicht automatisch zu einer manuellen Abstrafung durch Google - in den meisten Fällen wählt Google einfach eine der Varianten als kanonische Version aus und ignoriert die übrigen, statt die gesamte Website zu bestrafen. Auch ist nicht jeder wortwörtlich gleiche Textabschnitt problematisch: Wiederkehrende Elemente wie Navigationstexte oder rechtliche Hinweise gelten nicht als problematischer Duplicate Content im eigentlichen Sinn.