Noindex ist eine Anweisung an Suchmaschinen, eine bestimmte Seite nicht in den Suchindex aufzunehmen. Sie wird als Meta-Tag im HTML-Head oder als X-Robots-Tag im HTTP-Header gesetzt. Eine Seite mit noindex erscheint nicht in den Suchergebnissen — unabhängig davon, wie oft sie verlinkt oder gecrawlt wird.

Was ist Noindex?
Noindex ist eine Anweisung an Suchmaschinen, eine bestimmte Seite nicht in den Suchindex aufzunehmen. Eine Seite mit Noindex erscheint nicht in den Suchergebnissen – unabhängig davon, wie oft sie verlinkt oder besucht wird. Die Anweisung wird als Meta-Tag im HTML-Kopf oder als X-Robots-Tag im HTTP-Header gesetzt. Grundlagen erläutert der Wikipedia-Artikel zu Noindex.
Noindex ist ein wichtiges Werkzeug der Indexierungssteuerung und gehört zum technischen Handwerkszeug der Suchmaschinenoptimierung. Es hilft dabei, gezielt festzulegen, welche Seiten einer Website in der Suche auftauchen sollen und welche nicht – ein zentraler Hebel für sauberes technisches SEO.
Der Wert von Noindex liegt in der Trennung von Nutzen und Sichtbarkeit. Nicht jede Seite, die für Besucher hilfreich ist, soll auch in der Suche erscheinen. Interne Hilfsseiten, temporäre Aktionsseiten oder technische Zwischenseiten erfüllen ihren Zweck auf der Website, würden den Suchindex aber nur mit wenig relevanten Ergebnissen füllen. Noindex erlaubt es, solche Seiten bereitzustellen, ohne die Qualität der Suchergebnisse zu verwässern.
Wie wird Noindex technisch umgesetzt?
Am häufigsten steht Noindex als Robots-Meta-Tag im HTML-Head, also ein robots-Meta-Tag mit dem Inhalt noindex. Für Nicht-HTML-Dateien wie PDFs oder Bilder eignet sich das X-Robots-Tag im HTTP-Header, das dieselbe Anweisung serverseitig übermittelt. Beide Wege beschreibt die Google-Dokumentation zum Blockieren der Indexierung.
Neben der allgemeinen Anweisung an alle Suchmaschinen lässt sich Noindex auch gezielt für einzelne Crawler setzen, indem statt des allgemeinen robots-Bezeichners der Name eines bestimmten Bots angegeben wird. In der Praxis genügt für die meisten Websites jedoch die allgemeine Variante, die alle gängigen Suchmaschinen anspricht. Wichtig ist, die Anweisung serverseitig zuverlässig auszuliefern – dynamisch erzeugte Seiten müssen den Tag konsistent auf allen betroffenen URLs setzen, nicht nur auf einzelnen.
Damit Noindex wirkt, muss die Suchmaschine die Seite crawlen dürfen. Die Details der Meta-Angaben erklärt Google in der Doku zum Robots-Meta-Tag. Eine Kombination mit dem Attribut „follow“ oder „nofollow“ steuert zusätzlich, ob den Links auf der Seite gefolgt wird. Standard ist meist „noindex, follow“, damit Linkkraft weiter durch die Seite fließen kann.
Noindex, robots.txt und Crawling richtig unterscheiden
Ein häufiges Missverständnis ist die Verwechslung von Noindex mit einer Sperre in der robots.txt. Die robots.txt steuert das Crawling, also ob der Googlebot eine Seite überhaupt abruft. Noindex steuert dagegen die Indexierung, also ob die Seite in den Suchergebnissen erscheint. Der grundlegende Mechanismus geht auf den Robots Exclusion Standard zurück.
Wichtig ist die Reihenfolge: Wird eine Seite per robots.txt vom Crawling ausgeschlossen, kann die Suchmaschine den Noindex-Hinweis gar nicht lesen – die Seite könnte trotzdem, etwa über externe Links, im Index landen. Wer eine Seite sicher aus dem Index halten will, sollte sie also crawlen lassen und mit Noindex versehen, statt sie in der robots.txt zu blockieren. Die Funktionsweise der Steuerungsdatei erklärt die Google-Einführung zu robots.txt.
Diese Unterscheidung führt in der Praxis regelmäßig zu Fehlern, weil beide Mechanismen intuitiv gleich wirken. Merken lässt sich der Unterschied an einer einfachen Faustregel: robots.txt sagt der Suchmaschine, wo sie nicht hinschauen soll; Noindex sagt ihr, was sie zwar sehen, aber nicht in den Index aufnehmen soll. Wer eine Seite komplett unsichtbar machen will, kombiniert deshalb nicht beides, sondern lässt sie crawlen und setzt ausschließlich Noindex.
Wann ist Noindex sinnvoll?
Noindex eignet sich für Seiten, die für Nutzer nützlich, aber für die Suche wertlos oder sogar schädlich sind. Typische Kandidaten sind Danke-Seiten nach einem Formular, interne Suchergebnisseiten, Login-Bereiche, Druckansichten, Filter- und Sortiervarianten sowie Test- oder Staging-Seiten.
Ein besonders wichtiger Fall sind Danke-Seiten, die nach einem Kontaktformular oder Kauf erscheinen. Werden sie indexiert, können Nutzer direkt über die Suche darauf gelangen, ohne das Formular ausgefüllt zu haben – was das Conversion-Tracking verfälscht, weil dann Aufrufe ohne echte Handlung als Conversion gezählt werden. Ein Noindex auf solchen Seiten hält nicht nur den Index sauber, sondern schützt auch die Datenqualität der Erfolgsmessung.
Auch im Umgang mit Duplicate Content und Thin Content kann Noindex helfen, indem minderwertige oder doppelte Seiten aus dem Index genommen werden. In vielen Fällen ist jedoch ein Canonical-Tag die bessere Wahl, weil er Signale bündelt, statt eine Seite ganz zu entfernen. Die Wahl hängt davon ab, ob die Seite verschwinden soll oder nur nicht als eigenständiges Original gelten soll.
Ein häufiger Anwendungsfall im E-Commerce sind Filter- und Sortierseiten, die durch Kombinationen unzählige URLs erzeugen. Würden sie alle indexiert, entstünden massenhaft nahezu identische Seiten, die sich gegenseitig Konkurrenz machen. Hier hilft eine bewusste Strategie: wenige aussagekräftige Kategorieseiten indexieren, die vielen Varianten dagegen per Noindex oder Canonical aus dem Wettbewerb nehmen. So bleibt die Sichtbarkeit auf die Seiten konzentriert, die tatsächlich ranken sollen.
Typische Fehler mit Noindex
Der folgenschwerste Fehler ist ein versehentliches Noindex auf wichtigen Seiten. Gerät die Anweisung – etwa nach einem Relaunch aus der Staging-Umgebung – auf Startseite oder zentrale Landingpages, verschwinden diese aus der Suche und der organische Traffic bricht ein. Solche Fehler bleiben oft lange unbemerkt.
Genau deshalb gehört Noindex zu den ersten Dingen, die nach jedem Website-Umzug oder Relaunch geprüft werden sollten. Entwicklungsumgebungen sind meist bewusst auf Noindex gesetzt, damit sie nicht in der Suche erscheinen. Wird eine solche Umgebung live geschaltet, ohne die Anweisung zu entfernen, ist die neue Website für Suchmaschinen unsichtbar. Eine kurze, systematische Kontrolle des Quelltexts der wichtigsten Seiten verhindert diesen teuren und häufigen Fehler zuverlässig.
Weitere Stolpersteine sind widersprüchliche Signale: Eine Seite gleichzeitig in der robots.txt zu sperren und mit Noindex zu versehen, verhindert, dass Noindex greift. Auch das dauerhafte Setzen von Noindex auf Seiten, deren Links noch Kraft weitergeben sollen, kann ungewollt schaden. Nach Änderungen empfiehlt sich eine Prüfung mit der Google Search Console, um die tatsächliche Indexierbarkeit zu kontrollieren.
Zu beachten ist außerdem, dass Noindex nicht sofort wirkt. Die Suchmaschine muss die Seite erneut crawlen, um die Anweisung zu erkennen und die Seite anschließend aus dem Index zu entfernen. Bei selten besuchten Seiten kann das einige Zeit dauern. Wer eine Seite dringend entfernt sehen will, kann in der Search Console zusätzlich eine temporäre Entfernung beantragen. Umgekehrt gilt: Wird ein Noindex wieder entfernt, dauert es ebenfalls, bis die Seite erneut aufgenommen wird.
Noindex im Kontext der Indexierungssteuerung
Noindex ist Teil eines größeren Werkzeugkastens, mit dem sich steuern lässt, wie Suchmaschinen eine Website erfassen. Dazu gehören die robots.txt, das Canonical-Tag, die XML-Sitemap und HTTP-Statuscodes. Jedes dieser Instrumente adressiert eine andere Frage – Crawling, Indexierung, Kanonisierung oder Erreichbarkeit.
Für eine gesunde Website-Struktur ist es entscheidend, diese Signale konsistent einzusetzen. Noindex beantwortet dabei präzise die Frage, ob eine konkrete Seite in den Suchergebnissen auftauchen soll. Richtig verwendet, hält es den Index schlank und lenkt die Sichtbarkeit auf die Seiten, die wirklich ranken sollen.
Ein sinnvoller Umgang mit Noindex ist damit auch eine Frage der Crawl-Budget-Ökonomie: Große Websites signalisieren so, welche Seiten unwichtig sind, und lenken die Aufmerksamkeit der Suchmaschine auf ihre stärksten Inhalte. In Kombination mit einer klaren URL-Struktur und sauberer interner Verlinkung entsteht eine Architektur, in der jede indexierte Seite einen Zweck erfüllt – ein Grundprinzip nachhaltiger Suchmaschinenoptimierung.