Noindex
Definition: Noindex ist eine Robots-Direktive, die einer Suchmaschine mitteilt, eine bestimmte Webseite nicht in ihren Suchindex aufzunehmen und damit aus den Suchergebnissen auszuschliessen. Sie wird entweder als Meta-Tag im <head> der Seite oder als HTTP-Response-Header (X-Robots-Tag) implementiert: <meta name="robots" content="noindex">
Erläuterung
Nicht jede Seite einer Website sollte in Google indexiert werden. Technische Seiten, duplizierte Inhalte, Danke-Seiten oder interne Suchergebnisse haben keinen SEO-Wert, belasten aber das Crawl-Budget und können die durchschnittliche Content-Qualität der gesamten Domain negativ beeinflussen. Noindex ist das präzise Werkzeug, um den Index zu bereinigen und Google auf die wirklich relevanten Seiten zu fokussieren.
Noindex vs. robots.txt: Der kritische Unterschied
- Noindex: Verhindert Indexierung, erlaubt aber weiterhin das Crawlen. Google muss die Seite besuchen, um den Noindex-Tag zu lesen.
- robots.txt Disallow: Verhindert das Crawlen – Google besucht die Seite gar nicht. Aber: Wenn eine geblockte Seite externe Links hat, kann sie trotzdem indexiert bleiben (ohne den Seiteninhalt zu kennen).
- Kombination problematisch: Wenn robots.txt eine Seite blockiert UND Noindex gesetzt ist, kann Google den Noindex-Tag nicht lesen – die Seite kann indexiert bleiben.
Wann Noindex sinnvoll ist
- Danke-Seiten (Thank-you-Pages): Nach Formularausfüllungen, Bestellungen; kein SEO-Wert
- Interne Suchseiten:
/suche?q=keyword– dünner Duplicate Content - Paginierungsseiten: /seite/2, /seite/3 etc. ohne eigenständigen SEO-Wert
- Filterseiten bei E-Commerce: URL-Parameter-Varianten ohne eigenständigen Inhalt
- Login-/Account-Seiten: Keine öffentlichen SEO-relevanten Inhalte
- Staging-/Testumgebungen: Verhindert versehentliche Indexierung von Entwicklungsseiten
- Dünne Inhalte, die nicht verbessert werden: Besser noindex als schwacher Content im Index
Implementierungsvarianten
- Meta-Tag:
<meta name="robots" content="noindex">– Standard für HTML-Seiten - Kombiniert:
<meta name="robots" content="noindex, nofollow">– Indexierung und Link-Following deaktivieren - X-Robots-Tag (HTTP-Header): Für Nicht-HTML-Ressourcen wie PDFs oder Bilder
- Googlebot-spezifisch:
<meta name="googlebot" content="noindex">– nur für Google
Noindex-Seiten aus dem Index entfernen
Nach dem Setzen von Noindex dauert es typischerweise Wochen bis Monate, bis Google die Seite aus dem Index entfernt – Google muss sie erst erneut crawlen. Für sofortige Entfernung: URL-Entfernungstool in der Google Search Console nutzen.