Duplicate Content
Definition: Duplicate Content bezeichnet Inhalte, die identisch oder nahezu identisch unter mehreren URLs erreichbar sind – entweder innerhalb derselben Website (interner Duplicate Content) oder auf verschiedenen Websites (externer Duplicate Content). Er ist problematisch für SEO, weil Suchmaschinen unklar ist, welche Version indexiert und gerankt werden soll, was zu Ranking-Verlusten, Crawl-Budget-Verschwendung und Link-Juice-Verwässerung führt.
Erläuterung
Duplicate Content ist in der Praxis meist kein absichtlicher Betrug, sondern ein technisches Problem: CMS-Systeme erzeugen ohne gezielte Konfiguration häufig mehrere URL-Varianten derselben Seite. Google hat mehrfach klargestellt, dass Duplicate Content in den meisten Fällen nicht zu einer manuellen Penalty führt – die negativen Auswirkungen auf Rankings sind jedoch real, weil der Link Juice auf mehrere URLs aufgeteilt wird und Google die „falsche" Version indexieren kann.
Interner Duplicate Content: häufige Ursachen
- URL-Varianten: www.seite.de vs. seite.de, http vs. https, /seite/ vs. /seite (trailing slash)
- URL-Parameter: /produkte?sort=preis&farbe=rot erzeugt eigene URLs für Filterkombinationen – besonders bei E-Commerce mit Faceted Navigation kritisch
- Tracking-Parameter: /seite?utm_source=newsletter erscheint als separate URL
- Session-IDs: Veraltete Systeme hängen Nutzer-Session-IDs an URLs
- Produktvarianten im Online-Shop: Gleiche Beschreibung bei verschiedenen Farben/Grössen
- Paginierung: Kategorienseiten mit mehreren Seiten (/seite/2/, /seite/3/)
- Print-Versionen: /artikel/ und /artikel/drucken/ mit identischem Inhalt
- CMS-Tags und Kategorien: Identische Blogartikel unter mehreren Taxonomie-URLs
Externer Duplicate Content
Externer Duplicate Content entsteht, wenn Inhalte auf mehreren verschiedenen Domains erscheinen:
- Content-Syndizierung: Artikel werden auf Partnerplattformen veröffentlicht (lösbar durch Cross-Domain-Canonical)
- Plagiate: Andere Sites kopieren Ihre Inhalte ohne Erlaubnis (Lösung: DMCA-Meldung oder Google-Meldung)
- Hersteller-Produktbeschreibungen: Händler übernehmen wortgleich Hersteller-Texte, die tausende andere Shops ebenfalls nutzen
Lösungsstrategien im Überblick
- 301-Redirect: Alle URL-Varianten dauerhaft auf die kanonische Version weiterleiten (z. B. HTTP → HTTPS, www → non-www)
- Canonical Tag: Bei technisch notwendigen Duplikaten (z. B. URL-Parameter) die bevorzugte URL angeben
- Noindex: Parameter-URLs, Filter-Seiten oder Paginierungs-Seiten aus dem Index ausschliessen, wenn kein Ranking-Potenzial vorhanden
- Inhaltsdifferenzierung: Seiten wirklich unterschiedlich gestalten – die einzig nachhaltige Lösung bei Produktvarianten
- robots.txt: Crawling von Parameter-URLs verhindern (nur wenn der Content wirklich nicht gecrawlt werden soll)
Duplicate Content finden
- Screaming Frog: Crawlt die Website und identifiziert Seiten mit identischen oder sehr ähnlichen Title Tags und Meta Descriptions
- Google Search Console: Doppelte Titel und Beschreibungen unter „Seiten" → „Doppelte Titel" oder „Doppelte Beschreibungen"
- Siteliner.com: Kostenloser Dienst, der interne Duplicate Content findet
- Copyscape: Prüft, ob Ihre Inhalte anderswo im Web kopiert wurden