Wie funktioniert die Indexierung?

Kurzantwort
Die Indexierung beginnt nach dem Crawling: Google analysiert Inhalte und Auszeichnungen, erkennt doppelte Seiten, wählt eine bevorzugte URL und speichert deren Merkmale im Google-Index. Die Aufnahme erfolgt nicht automatisch. Technische Sperren, widersprüchliche Signale, geringe Inhaltsqualität oder Duplikate können verhindern, dass eine Seite aufgenommen wird.
Die Indexierung entscheidet darüber, ob eine URL grundsätzlich in der Google-Suche erscheinen kann. Für Website-Betreiber zählt dabei weniger ein einzelnes Meta-Tag als die gesamte Signalkette aus Erreichbarkeit, Canonical, Sitemap, interner Verlinkung und Inhalt. Besonders wichtig: Google entscheidet selbst, welche URL als bevorzugte Version in den Index gelangt.
1. So funktioniert Indexierung
Indexierung bedeutet, dass Google eine zuvor entdeckte Seite verarbeitet und für mögliche Suchanfragen in seinem durchsuchbaren Datenbestand berücksichtigt. Crawling und Indexierung sind deshalb zwei getrennte Vorgänge: Der Googlebot kann eine URL abrufen, ohne dass Google sie anschließend in den Index aufnimmt. Umgekehrt kann eine bereits bekannte URL zeitweise im Index stehen, obwohl Google sie aktuell nicht erfolgreich crawlen kann.
Nach dem Abruf untersucht Google unter anderem den sichtbaren Text, Überschriften, Bilder, interne und externe Links, strukturierte Daten sowie technische Anweisungen. Google versucht außerdem zu verstehen, welches Thema die Seite behandelt, ob der Inhalt eigenständig ist und ob eine andere URL denselben oder einen sehr ähnlichen Inhalt bereitstellt.
Crawling ist noch keine Aufnahme
Ein erfolgreicher Abruf mit Statuscode 200 bestätigt nur, dass Google die Seite erreichen kann. Ob die URL indexiert wird, hängt zusätzlich von ihren Inhalten, Indexierungsanweisungen, Duplikaten und der von Google gewählten kanonischen Version ab.
1.1 So funktioniert Googles Indexierung
Googles Indexierung lässt sich als Auswahlprozess verstehen. Google verarbeitet die abgerufene Seite, ordnet ihre Inhalte ein, vergleicht sie mit bekannten Dokumenten und prüft, ob die URL eine eigenständige Version darstellt. Bei mehreren Varianten bündelt Google die Signale und bestimmt eine kanonische URL, also die aus Googles Sicht bevorzugte Adresse.
Der Canonical-Tag unterstützt diese Auswahl, ist für Google aber nur ein Hinweis. Fehlt er, ist er leer oder verweist er auf eine nicht erreichbare URL, kann Google selbst eine andere kanonische Adresse bestimmen. Die Technik-Checkliste der Performance Suite prüft deshalb unter anderem fehlende, leere und mehrfach vorhandene Canonical-Tags sowie Canonical-Ziele ohne Statuscode 200.
2. So geht Indexierung in fünf Schritten
Der Ablauf beginnt mit dem Crawling und endet mit einer Entscheidung über die Aufnahme. Die folgende Übersicht trennt die einzelnen Verarbeitungsschritte, weil sich ein Indexierungsproblem nur lösen lässt, wenn klar ist, an welcher Stelle der Prozess abbricht.
| Schritt | Was Google macht | Typisches Problem |
|---|---|---|
| 1. Abrufen | Googlebot fordert die URL und ihre Ressourcen an. | Robots-Sperre, Serverfehler oder schlechte Erreichbarkeit |
| 2. Verarbeiten | Google rendert und analysiert Inhalte, Links und Auszeichnungen. | Inhalte werden erst fehlerhaft per JavaScript geladen |
| 3. Bewerten | Google prüft Inhalt, Eigenständigkeit und mögliche Duplikate. | Dünner oder weitgehend kopierter Inhalt |
| 4. Kanonisieren | Google wählt aus ähnlichen Varianten eine bevorzugte URL. | Canonical, Sitemap und interne Links zeigen auf verschiedene URLs |
| 5. Speichern | Google nimmt die ausgewählte Seite mit ihren Merkmalen in den Index auf. | Noindex oder fehlender Mehrwert verhindert die Aufnahme |
Der Ablauf ist nicht bei jedem Crawl vollständig neu. Google aktualisiert bekannte Seiten regelmäßig, verarbeitet geänderte Inhalte und kann seine frühere Bewertung revidieren. Deshalb kann sich auch die kanonische URL ändern, obwohl du am Quellcode der betroffenen Seite nichts angepasst hast.
3. So funktioniert der Google-Index
Der Google-Index ist kein Verzeichnis, in dem jede erreichbare URL dauerhaft einen festen Platz erhält. Er ist ein laufend aktualisierter Bestand verarbeiteter Dokumente und ihrer Merkmale. Erst bei einer konkreten Suche prüft Google, welche indexierten Seiten zur Suchanfrage passen und in welcher Reihenfolge sie angezeigt werden.

Für Rankings reicht die reine Indexierung daher nicht aus. Eine Seite kann aufgenommen sein und trotzdem keinen messbaren organischen Traffic erhalten, wenn sie die Suchintention schwächer erfüllt als andere Ergebnisse, intern kaum verlinkt ist oder für keine relevante Suchanfrage ausreichend eindeutige Signale liefert.
3.1 Was die Indexierung mit Inhalten macht
Die Indexierung ordnet einer Seite nicht nur ihre URL zu. Google verarbeitet den Hauptinhalt, erkennt Beziehungen zwischen Text, Überschriften, Bildern und strukturierten Daten und verbindet das Dokument mit Themen und möglichen Suchanfragen. Welche Details Google tatsächlich speichert und für Rankings nutzt, entscheidet das Suchsystem selbst.
Strukturierte Daten können Google helfen, Inhaltstypen wie Produkte, Veranstaltungen oder häufige Fragen besser zuzuordnen. Sie erzwingen jedoch weder die Indexierung noch eine besondere Darstellung in den Suchergebnissen. Eine technisch korrekte Auszeichnung kann fehlenden oder austauschbaren Hauptinhalt nicht ausgleichen.
4. So lässt du eine Seite indexieren
Wer eine Seite indexieren lassen möchte, sollte zuerst sicherstellen, dass die URL erreichbar, intern verlinkt und indexierbar ist. Danach kann die URL über eine XML-Sitemap bereitgestellt und in der Google Search Console geprüft werden. Eine Indexierungsanfrage stößt eine erneute Prüfung an, garantiert aber keine Aufnahme.
Prüfe nicht nur die betroffene URL. Bei Vorlagenfehlern betrifft ein falscher Canonical oder ein unbeabsichtigtes Noindex schnell alle Produkt-, Kategorie- oder Standortseiten eines Seitentyps. Ein kostenloser SEO-Check liefert einen ersten Überblick über technische Auffälligkeiten und Metadaten.
5. Warum Google Seiten nicht aufnimmt
Eine Seite wird häufig nicht indexiert, weil Google sie nicht abrufen darf, ausdrücklich ein Noindex findet oder keinen ausreichenden Grund für eine zusätzliche URL erkennt. Auch schwankende Serverantworten und lange Ausfälle können dazu führen, dass Google eine Seite seltener verarbeitet oder eine frühere Aufnahme später überprüft.
Eine robots.txt-Sperre und eine Noindex-Anweisung erfüllen unterschiedliche Aufgaben. Die robots.txt verhindert den Abruf. Noindex kann Google erst zuverlässig verarbeiten, wenn der Bot die Seite abrufen darf. Eine gesperrte URL kann deshalb unter Umständen weiterhin ohne ausgelesenen Inhalt im Index erscheinen.
Ein weiteres Fehlerbild entsteht in automatisch erzeugten Sitemaps. Steht eine URL auf Noindex und gleichzeitig in der Sitemap, erhält Google zwei gegensätzliche Signale. Das Gleiche gilt für weitergeleitete oder nicht erreichbare Sitemap-URLs. Die Technik-Crawler-Checkliste empfiehlt deshalb, Noindex-Seiten sowie URLs ohne Statuscode 200 aus der Sitemap zu entfernen.
Weitere Gründe für eine fehlende Aufnahme sind sehr ähnliche Produktbeschreibungen, leere Kategorieseiten, massenhaft erzeugte Filter-URLs und Inhalte ohne eigene Aussage. Mehr Text löst dieses Problem nicht automatisch. Der bessere Ansatz ist eine klare Aufgabe pro URL: Jede indexierbare Seite sollte einen erkennbaren Nutzen und eine eigene Suchintention abdecken.
6. Google wählt die bevorzugte URL
Der Punkt, an dem Indexierung in der Praxis oft überraschend wird, sind widersprüchliche URL-Signale. Ein Produkt ist beispielsweise unter /produkt, /produkt?ref=123 und /kategorie/produkt erreichbar. Zeigt der Canonical auf die erste Version, während Sitemap und interne Links überwiegend die dritte verwenden, muss Google zwischen den Signalen abwägen.
Google kann in diesem Fall eine andere URL indexieren als die im Canonical angegebene. Das ist kein Beleg dafür, dass Canonicals wirkungslos sind. Es zeigt, dass Google auch Weiterleitungen, Inhalte, interne Links, externe Links, Sitemap-Einträge und die dauerhafte Erreichbarkeit der Varianten bewertet. Ohne Canonical kann Google ebenfalls selbst eine URL auswählen, die nicht der gewünschten Adresse entspricht.
Die zuverlässigste Entscheidungshilfe lautet deshalb: Prüfe zuerst, ob wirklich alle Signale auf dieselbe Version zeigen. Die gewünschte URL sollte Statuscode 200 liefern, einen selbstreferenzierenden Canonical besitzen, in der Sitemap stehen und über interne Links erreichbar sein. Alternative Varianten sollten sauber weiterleiten oder konsistent auf die bevorzugte URL verweisen.
Wenn du diese technische Signalkette automatisiert kontrollieren möchtest, prüft der Technical Crawler der Performance Suite mehr als 100 technische Punkte pro URL, darunter Statuscodes und Canonicals.
Für eine laufende Prüfung kannst du einen kostenlosen Zugang anlegen:
7. Warum Seiten wieder verschwinden
Eine indexierte Seite hat keinen dauerhaften Bestandsschutz. Google kann eine URL später aus dem Index entfernen, wenn sie nicht mehr erreichbar ist, auf Noindex gesetzt wurde, durch eine andere Variante ersetzt wird oder im Vergleich zu ähnlichen Seiten keinen eigenständigen Nutzen mehr bietet. Das ist häufig eine neue Bewertung und kein technischer Fehler.
Ein typisches Beispiel ist ein Ratgeber, dessen Kernaussagen inzwischen vollständig in einer aktuelleren Seite enthalten sind. Google kann die ältere URL zunächst weiter crawlen, später jedoch die neuere Seite als bevorzugte Version behandeln. Eine erneute Indexierungsanfrage ändert diese Qualitätsentscheidung meist nicht. Sinnvoller sind eine Zusammenführung der Inhalte und eine passende Weiterleitung.
Auch Onlineshops erleben diesen Effekt nach Sortimentsänderungen. Leere Kategorien, ausverkaufte Produkte ohne Ersatzangebot und zahlreiche ähnliche Filterseiten verlieren ihren Zweck. Die richtige Reaktion ist nicht, jede ausgeschlossene URL zurück in den Index zu drücken. Priorisiere Seiten, die Nachfrage bedienen, interne Linkkraft erhalten und einen konkreten nächsten Schritt für den Nutzer bieten.
8. Indexierung prüfen 2026
Bei Indexierungsproblemen solltest du nicht mit einer pauschalen erneuten Einreichung beginnen. Prüfe zuerst, welche URL Google als kanonisch ausgewählt hat und ob sie mit deiner gewünschten Version übereinstimmt. Danach kontrollierst du Erreichbarkeit, Robots-Anweisungen, Sitemap, interne Links und Inhaltsüberschneidungen in genau dieser Reihenfolge.
Wenn einzelne Prüfungen kein klares Bild ergeben, ist eine isolierte URL-Analyse oft zu kurz gegriffen. Ein technisches und inhaltliches SEO-Audit untersucht zusätzlich Vorlagen, Seitentypen, interne Linkstrukturen und wiederkehrende CMS-Fehler. Das ist besonders bei großen Shops, Relaunches und internationalen Websites sinnvoll.
9. So gehen wir vor
Bei der OSG beginnen wir Indexierungsanalysen mit der gewünschten Ziel-URL und verfolgen anschließend jedes Signal, das Google zu einer anderen Auswahl führen könnte. Der Technical Crawler der Performance Suite verbindet Canonicals, Robots-Anweisungen, Sitemap-Daten, interne Verlinkung und Statuscodes in einer laufenden Prüfung. Eine feste Ansprechperson priorisiert anschließend die Fehler nach ihrer Wirkung auf wichtige Seiten und Suchanfragen. Bei umfangreichen oder widersprüchlichen Befunden liefert ein individuelles SEO-Audit die Grundlage für die technische Umsetzung.

10. Häufige Fragen zur Indexierung
Wie sehe ich, ob eine Seite bei Google indexiert ist?
Prüfe die URL in der Google Search Console mit der URL-Prüfung. Eine Site-Abfrage bei Google kann einen ersten Hinweis geben, ist aber weniger zuverlässig und nicht vollständig.
Wie lange dauert die Indexierung einer neuen Seite?
Die Aufnahme kann wenige Stunden, mehrere Tage oder deutlich länger dauern. Die Dauer hängt unter anderem von der Erreichbarkeit, internen Verlinkung, Domain-Aktivität, Inhaltsqualität und Crawling-Frequenz ab.
Kann ich Google zur Indexierung zwingen?
Nein. Du kannst eine URL über interne Links, die Sitemap und die Google Search Console zur Prüfung bereitstellen. Die Entscheidung über die Aufnahme trifft Google selbst.
Warum ignoriert Google meinen Canonical-Tag?
Google behandelt den Canonical-Tag als Hinweis. Wenn Sitemap, interne Links, Weiterleitungen, Inhalte oder Erreichbarkeit eine andere URL stützen, kann Google eine abweichende bevorzugte Version auswählen.
Verhindert die robots.txt die Indexierung?
Die robots.txt verhindert in erster Linie das Crawling. Eine gesperrte URL kann trotzdem anhand externer oder interner Links bekannt sein und ohne ausgelesenen Inhalt im Index erscheinen.
Warum ist eine Seite trotz Statuscode 200 nicht indexiert?
Der Statuscode 200 bestätigt nur die Erreichbarkeit. Noindex, Duplicate Content, eine andere kanonische URL, geringe Inhaltsqualität oder widersprüchliche Signale können die Aufnahme verhindern.
Können Seiten wieder aus dem Google-Index verschwinden?
Ja. Google überprüft indexierte Seiten fortlaufend und kann sie später als Duplikat, überflüssig, nicht erreichbar oder qualitativ zu schwach bewerten. Das muss kein technischer Fehler sein.
11. Klare Signale vor schneller Einreichung
Behandle Indexierung als Entscheidung von Google, die du durch Qualität und widerspruchsfreie Technik beeinflusst. Wenn eine wichtige Seite fehlt, prüfe zuerst die bevorzugte URL und gleiche danach Canonical, Sitemap, interne Links, Robots-Anweisungen und Statuscode ab. Diese Reihenfolge findet die Ursache schneller als wiederholte Indexierungsanfragen.
Wenn du die Signalkette gemeinsam prüfen möchtest, zeigt dir ein kostenloser Potenzialcheck, an welchen Seitentypen der größte technische Hebel liegt. Das Erstgespräch ist unverbindlich und auf deine Domain ausgerichtet.








Keine Kommentare vorhanden