Was ist ein Robots-Meta-Tag / X-Robots-Tag?

Was ist Was ist ein Robots-Meta-Tag / X-Robots-Tag??

Kurzantwort

Ein Robots-Meta-Tag steuert im HTML-Kopf, ob Suchmaschinen eine Seite indexieren und ihren Links folgen dürfen. Ein X-Robots-Tag übermittelt dieselben Anweisungen im HTTP-Antwortkopf des Servers. Dadurch eignet er sich auch für Dateien ohne HTML, etwa PDFs oder Bilder. Beide Varianten unterstützen Anweisungen wie noindex, nofollow und Vorgaben für Suchvorschauen.

Das Robots-Meta-Tag und der X-Robots-Tag beeinflussen Crawling, Indexierung und die Darstellung eines Suchergebnisses. Besonders wichtig ist die Abgrenzung zur robots.txt: Sie regelt primär den Zugriff des Crawlers, während Robots-Anweisungen die Verarbeitung einer abgerufenen Ressource steuern. Genau diese Trennung verhindert den häufigsten technischen Denkfehler bei der Indexierungssteuerung.

1. Was ist ein Robots-Meta-Tag?

Das Robots-Meta-Tag, auch Meta-Robots-Tag genannt, ist eine Anweisung im <head>-Bereich einer HTML-Seite. Es richtet sich an Suchmaschinen-Crawler und legt fest, ob die Seite in den Suchindex aufgenommen werden darf, ob Links verfolgt werden sollen und welche Inhalte Google als Vorschau anzeigen kann.

Eine typische Anweisung sieht so aus:

<meta name="robots" content="noindex, follow">

Diese Kombination bedeutet: Die betreffende Seite soll nicht in den Suchergebnissen erscheinen, ihre Links dürfen jedoch weiterhin verfolgt werden. Ohne ausdrückliche Angaben behandeln Suchmaschinen eine normale, erreichbare HTML-Seite üblicherweise wie index, follow. Das explizite Setzen dieser Standardwerte ist deshalb meist überflüssig.

Typische Einsatzfälle für noindex, follow sind interne Suchergebnisse, gefilterte Übersichtsseiten, Dankeseiten oder Inhalte, die Nutzer benötigen, die aber keinen eigenen Wert als Suchergebnis haben. Eine Dankeseite nach dem Absenden eines Formulars ist ein konkretes Beispiel aus der technischen Crawler-Prüfung.

2. Was ist ein X-Robots-Tag?

Der X-Robots-Tag erfüllt denselben grundsätzlichen Zweck, wird aber nicht im HTML-Code hinterlegt. Der Webserver sendet ihn als HTTP-Antwortkopf zusammen mit der angeforderten Ressource. Ein möglicher Antwortkopf lautet:

X-Robots-Tag: noindex, follow

Der wesentliche Vorteil liegt im Dateiformat. Ein PDF-Dokument, eine Bilddatei oder eine andere Nicht-HTML-Ressource besitzt keinen HTML-Kopf, in den ein Meta-Tag eingefügt werden könnte. Mit einem X-Robots-Tag lässt sich trotzdem festlegen, dass beispielsweise ein PDF nicht als eigenständiges Suchergebnis erscheinen soll.

Die Konfiguration erfolgt je nach System im Webserver, in der Anwendung, über ein Plugin oder über Regeln des Content-Management-Systems. Vor der Umsetzung sollte deshalb geklärt werden, ob die Anweisung nur für eine Datei, ein Dateiformat oder einen vollständigen Verzeichnispfad gelten soll. Eine pauschale Serverregel für alle PDFs kann auch wichtige Whitepaper, Datenblätter oder Produktunterlagen aus dem Index entfernen.

3. Meta-Robots und X-Robots im Vergleich

MerkmalRobots-Meta-TagX-Robots-Tag
ÜbertragungIm HTML-Kopf der SeiteIm HTTP-Antwortkopf des Servers
Geeignete InhalteHTML-SeitenHTML und Dateien ohne HTML
Typische BeispieleKategorie, Suchseite, DankeseitePDF, Bild oder generierte Datei
UmsetzungTemplate, CMS oder QuellcodeServer, Anwendung oder HTTP-Konfiguration
KontrolleHTML-Quellcode prüfenHTTP-Antwortkopf prüfen

Für eine normale Webseite ist das Robots-Meta-Tag meist leichter zu pflegen, weil die Anweisung direkt im Seitentemplate sichtbar ist. Der X-Robots-Tag ist sinnvoll, wenn kein HTML vorhanden ist oder wenn Regeln zentral auf Serverebene gesetzt werden sollen. Werden beide Varianten gleichzeitig verwendet, dürfen sie sich nicht widersprechen. Suchmaschinen können mehrere empfangene Anweisungen zusammenführen und dabei die restriktivere Vorgabe anwenden.

Technik Crawler Performance Suite

Bei größeren Websites reicht die Prüfung einzelner Quellcodes nicht aus. Ein technischer Crawl muss je URL erfassen, ob sie erreichbar, indexierbar, durch die robots.txt freigegeben und mit einem passenden Canonical-Tag versehen ist. Eine URL gilt nur dann als regulär indexierbar, wenn kein noindex greift, die robots.txt den Abruf zulässt und kein Canonical auf eine andere URL verweist.

4. Die wichtigsten Robots-Anweisungen

Robots-Anweisungen können einzeln oder kombiniert eingesetzt werden. Jede Direktive beantwortet eine andere Frage: Darf die Ressource in den Index, dürfen Links verfolgt werden und wie umfangreich darf das Suchergebnis dargestellt werden?

  • index: Die Ressource darf in den Suchindex aufgenommen werden. Dieser Wert entspricht bei normalen, erreichbaren Seiten meist dem Standard.
  • noindex: Die Ressource soll nicht im Suchindex erscheinen.
  • follow: Suchmaschinen dürfen den Links auf der Seite folgen. Auch dieser Wert gilt üblicherweise als Standard.
  • nofollow: Die Links auf der Seite sollen nicht verfolgt beziehungsweise nicht für die Weitergabe von Linksignalen genutzt werden.
  • nosnippet: Für das Suchergebnis soll kein Textausschnitt und keine Videovorschau angezeigt werden.
  • max-snippet: Die maximale Länge des Textausschnitts wird als Zeichenanzahl festgelegt.
  • max-image-preview: Die Größe einer Bildvorschau lässt sich mit none, standard oder large steuern.
  • noimageindex: Bilder der betreffenden Seite sollen nicht als eigenständige Bildsuchergebnisse indexiert werden.

Robots-Merksatz

Noindex steuert die Aufnahme der Seite, nofollow steuert den Umgang mit ihren Links. Eine Seite mit noindex, follow kann aus dem Index entfernt werden, während der Crawler ihre internen Links weiterhin entdeckt. Eine Seite mit index, nofollow darf dagegen selbst erscheinen, ihre Links sollen aber nicht verfolgt werden.

5. Der häufigste Fehler mit robots.txt

Der technische Kipppunkt entsteht, wenn eine URL gleichzeitig per robots.txt gesperrt und mit noindex ausgezeichnet wird. Das wirkt auf den ersten Blick besonders sicher. Tatsächlich verhindert die robots.txt jedoch, dass der Crawler die Seite abruft. Dadurch kann er weder das Robots-Meta-Tag im HTML noch einen X-Robots-Tag auswerten.

Google kann eine gesperrte URL trotzdem über interne Links, externe Backlinks oder eine Sitemap kennenlernen. Die URL kann dann weiterhin im Index auftauchen, obwohl ihr Inhalt nicht gecrawlt wurde. Häufig erscheint sie ohne normalen Seitenausschnitt. Wer nur im Quellcode nach noindex schaut, übersieht den eigentlichen Widerspruch.

Eine robots.txt-Sperre und noindex sind für die Entfernung aus dem Index keine sinnvolle Kombination. Soll eine Seite zuverlässig aus den Suchergebnissen verschwinden, muss sie zunächst crawlbar bleiben. Erst dann kann die Suchmaschine das noindex lesen und verarbeiten. Diese Kombination aus Sperre und noindex ist der häufigste technische Denkfehler bei der Indexierungssteuerung.

Bei bereits indexierten URLs sollte die robots.txt-Freigabe so lange bestehen bleiben, bis die Suchmaschine das noindex erneut abgerufen und umgesetzt hat. Die robots.txt ist außerdem kein Schutz für vertrauliche Inhalte. Kundenbereiche, Rechnungen oder interne Unterlagen gehören hinter eine Authentifizierung, weil robots.txt-Regeln öffentlich einsehbar sind.

6. Crawling oder Indexierung steuern?

Vor jeder technischen Änderung musst du eine Frage beantworten: Soll der Crawler eine Ressource gar nicht besuchen oder soll er sie lesen, aber nicht als Suchergebnis aufnehmen? Aus dieser Entscheidung ergibt sich das richtige Instrument.

  • Besuch begrenzen: Nutze die robots.txt, wenn Crawling in einem Bereich vermieden werden soll. Sie ist keine zuverlässige Methode zur Entfernung aus dem Index.
  • Indexierung verhindern: Lasse die Ressource crawlbar und verwende noindex im Robots-Meta-Tag oder X-Robots-Tag.
  • Vertrauliche Inhalte schützen: Nutze Login, Zugriffskontrolle oder serverseitige Authentifizierung.
  • Doppelte Inhalte bündeln: Prüfe, ob ein Canonical-Tag oder eine Weiterleitung besser zum Ziel passt.

Bei Onlineshops betrifft diese Entscheidung häufig Filter- und Sortier-URLs. Eine pauschale Crawling-Sperre kann verhindern, dass Suchmaschinen relevante Produktlinks entdecken. Ein flächendeckendes noindex kann dagegen wertvolle Kategorieseiten aus den SERP entfernen. Die richtige Regel richtet sich deshalb nach URL-Typ, interner Verlinkung und Suchnachfrage, nicht allein nach der Anzahl der URLs.

Wenn du technische Signale und Indexierbarkeit selbst prüfen möchtest, kannst du mit einem Free Account einen ersten Überblick über deine Domain erhalten.

Free Account anlegen

7. Robots-Tags richtig prüfen

Ein Quellcode-Check zeigt nur das Robots-Meta-Tag. Für eine vollständige Prüfung müssen zusätzlich die HTTP-Antwortköpfe, der Statuscode, die robots.txt, Canonical-Tags und gegebenenfalls Weiterleitungen betrachtet werden. Ein PDF mit korrektem X-Robots-Tag kann beispielsweise trotzdem über eine Weiterleitung anders behandelt werden als erwartet.

Eine belastbare Prüfung umfasst mindestens diese Schritte:

  • Rufe die URL ohne Browser-Cache und mit ihrem finalen Statuscode ab.
  • Prüfe im HTML-Kopf, ob ein Robots-Meta-Tag vorhanden ist.
  • Kontrolliere die HTTP-Header auf einen X-Robots-Tag.
  • Vergleiche die Anweisungen mit der robots.txt und dem Canonical-Ziel.
  • Prüfe, ob Sitemap und interne Links dieselbe Indexierungsabsicht vermitteln.
  • Kontrolliere nach Änderungen den tatsächlichen Indexierungsstatus.

Der Technical Crawler der Performance Suite prüft Robots-Anweisungen je URL und stellt technische Widersprüche im Zusammenhang dar. Dazu gehören beispielsweise indexierbare Seiten außerhalb der Sitemap, versehentlich ausgeschlossene Seiten sowie Kombinationen aus Meta-Anweisung, robots.txt und Canonical. Die Technik-Prüfung bewertet über 100 technische Punkte und zeigt Veränderungen über mehrere Crawls.

Für einen kompakten Einstieg kannst du außerdem den kostenlosen SEO-Check für Technik und Metadaten nutzen. Er analysiert neben technischen Grundlagen auch Ladezeiten und weitere SEO-Signale für bis zu 20 Unterseiten pro Abfrage.

Mit Nutzung dieses SEO-Checks erklären Sie, dass Sie die Datenschutzerklärung zur Kenntnis genommen haben und damit einverstanden sind, dass die von Ihnen angegebenen Daten elektronisch erhoben und gespeichert werden. Ihre Daten werden dabei nur streng zweckgebunden zur Bearbeitung des SEO-Checks benutzt. Mit der Nutzung dieses SEO-Checks erklären Sie sich mit der Verarbeitung einverstanden.

8. So gehen wir vor

Bei der Online Solutions Group GmbH prüfen wir zuerst, welche URL-Typen organisch gefunden werden sollen und welche nur eine technische Funktion erfüllen. Danach vergleichen wir Robots-Meta-Tags, X-Robots-Tags, Canonicals, Statuscodes, Sitemap und robots.txt je URL. Der Technical Crawler der Performance Suite übernimmt die wiederkehrende Kontrolle, während unsere Experten widersprüchliche Signale priorisieren und mit der IT abstimmen. Diese technische Prüfung ist Bestandteil unserer SEO- und GEO-Betreuung, bei der Maßnahmen und Ergebnisse für den Kunden live einsehbar bleiben.

9. Häufige Fragen zu Robots-Tags

Wo wird der Meta-Robots-Tag eingebaut?

Der Meta-Robots-Tag steht im Kopfbereich einer HTML-Seite. Er muss innerhalb des head-Elements eingebunden sein, damit Suchmaschinen ihn beim Abruf der Seite erkennen können.

Wann brauche ich einen X-Robots-Tag?

Ein X-Robots-Tag eignet sich besonders für PDFs, Bilder und andere Dateien ohne HTML-Kopf. Er wird vom Server im HTTP-Antwortkopf der angeforderten Ressource übermittelt.

Kann eine per robots.txt gesperrte Seite im Google-Index bleiben?

Ja. Google kann die URL über Links oder eine Sitemap kennen und indexieren, ohne ihren Inhalt zu crawlen. Weil die Seite gesperrt ist, kann Google ein dort hinterlegtes noindex nicht lesen.

Was ist der Unterschied zwischen noindex und nofollow?

Noindex verhindert die Aufnahme einer Seite in den Suchindex. Nofollow weist Suchmaschinen an, den Links auf dieser Seite nicht zu folgen beziehungsweise keine Linksignale über sie weiterzugeben.

Ist index, follow notwendig?

In der Regel nicht. Wenn keine einschränkende Robots-Anweisung vorhanden ist und die Seite crawlbar bleibt, behandeln Suchmaschinen sie üblicherweise wie index, follow.

Kann ich Meta-Robots und X-Robots gleichzeitig verwenden?

Ja, die Anweisungen müssen jedoch zueinander passen. Widersprüchliche Vorgaben erschweren die Kontrolle und können dazu führen, dass eine Suchmaschine die restriktivere Anweisung anwendet.

Wie lange dauert es, bis Google ein noindex umsetzt?

Google muss die betreffende URL erneut crawlen, bevor das noindex verarbeitet werden kann. Die Dauer hängt unter anderem von Crawl-Frequenz, interner Verlinkung und technischer Erreichbarkeit ab.

10. Die richtige Regel je URL

Robots-Anweisungen funktionieren zuverlässig, wenn jede URL eine eindeutige Aufgabe erhält. Soll sie ranken, bleibt sie indexierbar. Soll sie nur für Nutzer erreichbar sein, bleibt sie crawlbar und erhält noindex. Soll sie vertraulich bleiben, braucht sie eine Zugriffskontrolle. Bei größeren Websites sollte diese Logik regelmäßig automatisiert geprüft werden, weil eine einzige vererbte Template-Regel ganze Seitenbereiche aus dem Index nehmen kann. Weitere technische Begriffe kannst du im SEO-Lexikon von seoagentur.de nachschlagen.

Du möchtest wissen, ob deine Website widersprüchliche Robots-Anweisungen ausliefert? Im kostenlosen Potenzialcheck ordnen wir ein, welche technischen Signale zuerst geprüft werden sollten. Das Erstgespräch ist unverbindlich und ohne Verkaufsdruck.

Kostenlosen Potenzialcheck anfragen

SEO Agentur kostenlose SEO Potentialanalyse



Weitere Inhalte


Keine Kommentare vorhanden


Du hast eine Frage oder eine Meinung zum Artikel? Teile sie mit uns!

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind markiert *

*
*