noindex
noindex ist eine Anweisung an Suchmaschinen, eine bestimmte Seite nicht in den Suchindex aufzunehmen, meist per Meta-Tag oder HTTP-Header gesetzt.
Kurz erklärt
noindex wird meist über ein Meta-Tag im <head>-Bereich einer Seite gesetzt: <meta name="robots" content="noindex">. Findet ein Suchmaschinen-Crawler diese Anweisung, nimmt er die Seite nicht in den durchsuchbaren Suchindex auf - sie taucht damit nicht mehr in den organischen Suchergebnissen auf, auch wenn sie weiterhin normal aufrufbar bleibt.
Beispiel
Eine interne Suchergebnisseite oder eine Danke-Seite nach einem Formularversand hat für die organische Suche meist keinen eigenständigen Wert. Solche Seiten werden häufig gezielt mit noindex versehen, um zu verhindern, dass sie unerwünscht in den Suchergebnissen erscheinen.
Warum ist das relevant?
noindex ist ein wichtiges Werkzeug, um Suchmaschinen gezielt zu steuern, welche Seiten einer Website öffentlich auffindbar sein sollen - etwa bei Duplicate Content, internen Werkzeugen oder Seiten mit geringem eigenständigem Mehrwert. Ein versehentlich gesetztes noindex auf einer eigentlich wichtigen Seite ist zugleich einer der folgenreichsten technischen SEO-Fehler, da die Seite dadurch faktisch aus der Suche verschwindet.
Häufige Missverständnisse
Eine Seite, die per robots.txt vom Crawling ausgeschlossen wird, verhindert damit nicht zuverlässig ihre Indexierung - kennt eine Suchmaschine die URL bereits durch externe Links, kann sie die Seite trotz Crawling-Sperre unter Umständen ohne Inhaltsvorschau indexieren. Für ein zuverlässiges Ausschließen aus dem Suchindex ist noindex das richtige Werkzeug, nicht robots.txt. Auch funktioniert noindex nur, wenn die Seite überhaupt gecrawlt werden darf - schließt robots.txt eine Seite vom Crawling aus, kann ein Crawler das noindex-Tag auf dieser Seite gar nicht erst entdecken.