Noindex
Was ist Noindex?
Noindex ist eine Anweisung an Suchmaschinen, eine bestimmte Webseite oder Datei nicht in ihren Suchindex aufzunehmen. Die Direktive wird als Robots-Meta-Tag im HTML-Code oder als X-Robots-Tag im HTTP-Header ausgegeben. Die URL bleibt erreichbar und darf grundsätzlich weiterhin gecrawlt werden, erscheint aber nach der Verarbeitung nicht in den organischen Suchergebnissen.
Was bedeutet Noindex für Suchmaschinen?
Noindex steuert die Indexierung einer URL und verhindert ihre Darstellung in den Suchergebnissen unterstützender Suchmaschinen. Ein Suchmaschinen-Crawler muss die URL zunächst aufrufen und die Anweisung auslesen können. Nach der Verarbeitung entfernt die Suchmaschine die Seite aus ihrem Index oder nimmt sie gar nicht erst auf.
Die Direktive ist kein Zugriffsschutz. Nutzer, Suchmaschinen-Crawler und andere automatisierte Systeme können eine mit Noindex gekennzeichnete URL weiterhin aufrufen, sofern keine Anmeldung, Zugriffsbeschränkung oder andere technische Sperre besteht. Vertrauliche Inhalte müssen deshalb durch eine Authentifizierung oder serverseitige Zugriffskontrolle geschützt werden.
Crawling und Indexierung bezeichnen unterschiedliche Prozesse. Beim Crawling ruft ein Bot eine URL ab und analysiert ihre Inhalte. Bei der Indexierung verarbeitet und speichert die Suchmaschine diese Informationen für mögliche Suchergebnisse. Die Anweisung betrifft primär den zweiten Prozess und setzt voraus, dass der Crawler sie erkennen kann.
Wie wird eine Seite von der Indexierung ausgeschlossen?
Für HTML-Seiten wird die Anweisung üblicherweise als Robots-Meta-Tag im Kopfbereich des Dokuments hinterlegt. Die allgemeine Variante richtet sich an alle Suchmaschinen-Crawler, die diese Direktive unterstützen:
<meta name="robots" content="noindex">. Für Dateien ohne eigenen HTML-Kopfbereich kann der Server stattdessen den HTTP-Header X-Robots-Tag: noindex ausgeben. Beide Varianten verfolgen denselben Zweck, werden aber an unterschiedlichen Stellen technisch hinterlegt.Eine auf Google beschränkte Anweisung kann über <meta name="googlebot" content="noindex"> erfolgen. Eine solche Einschränkung ist nur sinnvoll, wenn andere unterstützende Suchmaschinen die Seite weiterhin indexieren dürfen. Für eine allgemeine Deindexierung sollte der Crawler-Name robots verwendet werden.
Wann wird der X-Robots-Tag eingesetzt?
Der X-Robots-Tag eignet sich für PDF-Dokumente, Bilder, Videos und andere Ressourcen, in denen kein Robots-Meta-Tag hinterlegt werden kann. Er wird als Bestandteil der HTTP-Antwort durch den Webserver, das Content-Management-System oder eine Anwendung ausgeliefert. Dadurch lassen sich auch bestimmte Dateitypen oder URL-Gruppen zentral steuern.
Noindex, Nofollow und Robots.txt im Vergleich
Der Unterschied zwischen Noindex und Nofollow liegt im gesteuerten Vorgang. Noindex betrifft die Aufnahme einer Ressource in den Suchindex. Nofollow weist einen Crawler darauf hin, den Links auf der betreffenden Seite nicht zu folgen beziehungsweise sie nicht regulär für die Entdeckung und Bewertung verlinkter URLs zu verwenden.
Die Kombination noindex, follow bedeutet, dass die Seite nicht in den Suchergebnissen erscheinen soll, ihre Links aber grundsätzlich verarbeitet werden dürfen. Da Suchmaschinen eine dauerhaft ausgeschlossene Seite mit der Zeit seltener crawlen können, sollte sie nicht als zentraler Verteiler für wichtige interne Links eingeplant werden.
Die Kombination noindex, nofollow schließt die Seite aus dem Index aus und enthält zusätzlich eine Nofollow-Anweisung für ihre Links. Der Wert none entspricht bei Google der Kombination aus Noindex und Nofollow. Ohne einschränkende Angabe gelten grundsätzlich die Standardwerte index, follow.
Warum reicht ein Disallow in der Robots.txt nicht aus?
Eine Disallow-Regel in der Robots.txt steuert den Abruf einer URL, verhindert aber nicht zuverlässig ihre Indexierung. Ist eine gesperrte URL über interne oder externe Links bekannt, kann sie unter Umständen ohne ausgelesenen Seiteninhalt in den Suchergebnissen erscheinen. Die Robots.txt ist daher kein Ersatz für eine Indexierungsanweisung.
Noindex und eine Crawling-Sperre sollten für dieselbe Webseite nicht gleichzeitig eingesetzt werden. Wenn die Robots.txt den Zugriff blockiert, kann der Crawler das Meta-Tag oder den HTTP-Header nicht erkennen. Die URL muss abrufbar bleiben, bis die Suchmaschine die Anweisung verarbeitet und die Seite aus dem Index entfernt hat.
Für welche Seiten ist Noindex sinnvoll?
Die Direktive eignet sich für erreichbare Seiten, die Nutzern oder internen Prozessen dienen, aber keinen eigenständigen Mehrwert für organische Suchergebnisse bieten. Vor der Verwendung sollte geprüft werden, ob die URL dauerhaft erreichbar bleiben muss oder stattdessen gelöscht, weitergeleitet oder inhaltlich verbessert werden sollte.
Bei dünnen, veralteten oder qualitativ schwachen Inhalten ist Noindex nicht automatisch die richtige Lösung. Besitzt eine URL relevante Backlinks, Rankings oder Nutzersignale, kommen eine Überarbeitung, Zusammenführung oder 301-Weiterleitung häufig eher infrage. Ein technischer und inhaltlicher SEO-Audit schafft die Datenbasis für diese Entscheidung.
Was ist der Unterschied zum Canonical-Tag?
Ein Canonical-Tag kennzeichnet die bevorzugte URL innerhalb einer Gruppe gleicher oder sehr ähnlicher Inhalte. Die alternative URL darf grundsätzlich indexiert werden, während die Suchmaschine die Signale möglichst der kanonischen Version zuordnet. Noindex fordert dagegen den vollständigen Ausschluss der markierten URL aus den Suchergebnissen.
Für interne Duplikate sollte in der Regel ein Canonical-Tag verwendet werden, wenn die URL erreichbar bleiben und ihre Signale einer Hauptversion zugeordnet werden sollen. Google empfiehlt Noindex nicht als Methode zur Auswahl einer kanonischen Seite, weil die Anweisung die betreffende URL vollständig aus der Suche ausschließt.
Welche Bedeutung hat die Direktive für SEO, SEA und GEO?
Im SEO reduziert eine korrekte Indexierungssteuerung die Zahl irrelevanter URLs in den Suchergebnissen und verhindert, dass technische Seiten mit wichtigen Landingpages konkurrieren. Ein versehentlicher Ausschluss umsatzrelevanter Kategorien, Produkte oder Ratgeber kann dagegen Rankings und organischen Traffic vollständig beseitigen.
Im SEA kann eine ausgeschlossene Landingpage weiterhin über eine Anzeige aufgerufen werden. Die Anweisung allein verhindert weder den Zugriff durch Nutzer noch automatisch die Prüfung durch spezielle Werbe-Crawler. Für Landingpages, die zusätzlich organisches Suchpotenzial besitzen, sollte jedoch geprüft werden, ob der Ausschluss langfristig sinnvoll ist.
Für GEO, die Generative Engine Optimization, begrenzt eine ausgeschlossene URL ihre Auffindbarkeit über suchmaschinenbasierte KI-Funktionen. Unabhängige KI-Crawler und Sprachmodelle können eigene Zugriffsregeln verwenden. Die Direktive ist daher keine allgemeine Sperre gegen die Verarbeitung durch sämtliche KI-Systeme und schützt keine vertraulichen Informationen.
Wie lässt sich die Umsetzung kontrollieren?
Die Kontrolle beginnt mit dem Quellcode und den HTTP-Headern der betroffenen URL. Anschließend sollte geprüft werden, ob die URL durch die Robots.txt abrufbar ist, welchen HTTP-Statuscode sie liefert und ob widersprüchliche Angaben durch Plugins, Templates oder Serverkonfigurationen entstehen.
Ein häufiger Fehler entsteht bei Website-Relaunches, wenn Anweisungen aus einer Entwicklungsumgebung in die Live-Website übernommen werden. Deshalb gehört die Prüfung indexierbarer Seitentypen in jede SEO-Checkliste für einen Website-Relaunch. Auch ein regelmäßiger SEO-Check für technische Seitensignale kann auffällige Konfigurationen sichtbar machen.
Indexierungssteuerung fachlich prüfen lassen
Wenn wichtige URLs unerwartet aus den Suchergebnissen verschwinden oder zu viele technische Seiten indexiert werden, sollte die gesamte Steuerung aus Robots.txt, Meta-Tags, HTTP-Headern, Canonicals und Sitemaps gemeinsam geprüft werden. Eine isolierte Änderung kann sonst neue Widersprüche erzeugen.
Kostenlose ErstberatungHäufige Fragen zur Noindex-Anweisung
Die folgenden Antworten behandeln typische Detailfragen, die bei der technischen Umsetzung, bei Änderungen am Seitenbestand und bei der Kontrolle in Suchmaschinen auftreten.
Wie lange dauert die Entfernung einer Seite aus Google?
Die Entfernung erfolgt erst, nachdem Google die URL erneut gecrawlt und die Anweisung verarbeitet hat. Abhängig von der Crawling-Frequenz kann dies wenige Tage, mehrere Wochen oder bei selten besuchten URLs länger dauern.
Kann eine ausgeschlossene Seite weiterhin Besucher erhalten?
Ja. Die Seite bleibt über direkte Aufrufe, Lesezeichen, interne Links, externe Links, Newsletter, soziale Netzwerke und bezahlte Anzeigen erreichbar. Ausgeschlossen wird lediglich ihre Darstellung in den Suchergebnissen unterstützender Suchmaschinen.
Soll eine ausgeschlossene URL in der XML-Sitemap stehen?
Dauerhaft ausgeschlossene URLs sollten in der Regel nicht in der XML-Sitemap stehen. Eine Sitemap soll bevorzugt indexierbare, kanonische URLs enthalten. Andernfalls sendet die Website widersprüchliche Signale zur gewünschten Indexierung.
Kann man einzelne Suchmaschinen vom Index ausschließen?
Ja. Statt eines allgemeinen Robots-Meta-Tags kann die Anweisung an einen bestimmten unterstützten Crawler adressiert werden. Dabei muss dessen korrekte Bezeichnung verwendet werden. Andere Suchmaschinen dürfen die Seite dann weiterhin indexieren.
Ist Noindex für gelöschte Seiten geeignet?
Für dauerhaft entfernte Inhalte sind häufig ein HTTP-Statuscode 404 oder 410 beziehungsweise eine passende 301-Weiterleitung geeigneter. Eine ausgeschlossene Seite liefert weiterhin einen regulären Inhalt und bleibt technisch erreichbar.
Kann JavaScript die Indexierungsanweisung setzen?
Eine Anweisung kann technisch durch JavaScript erzeugt werden, die serverseitige Ausgabe im ursprünglichen HTML oder HTTP-Header ist jedoch leichter kontrollierbar. Bei JavaScript muss sichergestellt sein, dass der Suchmaschinen-Crawler die gerenderte Anweisung zuverlässig erhält.
Sie haben noch Fragen?







