← Zurück zum Blog

So prüfst du, ob eine Seite bei Google indexiert ist

So prüfst du, ob eine Seite bei Google indexiert ist

Um zu prüfen, ob eine Seite bei Google indexiert ist, fügst du ihre URL in der Search Console in die URL-Prüfung ein, oder du machst für eine grobe Antwort schnell eine site:-Suche. Ist die Seite nicht indexiert, kann sie weder ranken noch organischen Traffic bekommen, egal wie gut sie ist, und für Besucher sieht sie trotzdem völlig normal aus.

Im Folgenden findest du vier Methoden, von der schnellsten bis zur gründlichsten, dazu die häufigsten Gründe, warum eine Seite aus dem Index fällt, und warum ein Check vom letzten Monat heute nicht mehr stimmen muss.

Gecrawlt, indexiert und gerankt sind drei verschiedene Zustände

Die Begriffe werden oft durcheinandergeworfen, und das sorgt beim Lesen der Search Console für Verwirrung.

Gecrawlt heißt, dass der Googlebot die Seite abgerufen hat. Indexiert heißt, dass Google sie verarbeitet und als geeignet für die Suchergebnisse gespeichert hat. Gerankt heißt, dass sie bei Suchanfragen tatsächlich erscheint. Jeder Schritt setzt den vorherigen voraus, aber keiner garantiert den nächsten. Eine Seite kann gecrawlt und nie indexiert werden, und eine indexierte Seite kann auf Seite neun ranken.

Wenn du fragst, ob eine Seite indexiert ist, geht es um den mittleren Schritt. Lautet die Antwort nein, bringen Arbeit am Content und Linkaufbau für diese Seite nichts, solange das Indexierungsproblem nicht gelöst ist.

Methode 1: der site:-Operator

Such bei Google nach site: gefolgt von der URL, zum Beispiel site:example.com/preise/. Gibt es ein Ergebnis, ist die Seite so gut wie sicher indexiert. Gibt es keins, ist sie es wahrscheinlich nicht.

Das ist ein Fünf-Sekunden-Test und nicht mehr. Der Operator zeigt kein vollständiges Bild des Index, lässt manchmal indexierte Seiten weg und sagt dir nichts darüber, warum eine Seite fehlt. Nimm ihn für eine schnelle Plausibilitätsprüfung, nicht für eine Diagnose.

Methode 2: die URL-Prüfung in der Search Console

Für eine einzelne URL liefert dieses Tool die verbindliche Antwort. Öffne die Property in der Google Search Console, füge die vollständige URL oben in die Suchleiste ein und lies das Ergebnis: „URL ist auf Google“ oder „URL ist nicht auf Google“.

Interessant wird es bei den Details darunter. Im Abschnitt zur Seitenindexierung siehst du, ob Crawling erlaubt war, ob Indexierung erlaubt war, wann zuletzt gecrawlt wurde, welche kanonische URL vom Nutzer angegeben und welche von Google ausgewählt wurde. Ist die Seite ausgeschlossen, wird der Grund genannt, zum Beispiel:

„Live-URL testen“ ruft die Seite in ihrem aktuellen Zustand ab. Das hilft nach einer Korrektur, denn der Hauptbericht zeigt die Version vom letzten Crawl. Ist das Problem behoben, bittet „Indexierung beantragen“ Google um einen neuen Crawl, eine Aufnahme in den Index garantiert das aber nicht. Die Grenze des Tools: Es funktioniert nur für eine URL auf einmal und nur für Properties, die du bestätigt hast.

Methode 3: der Bericht „Seiten“

Für eine ganze Website gehst du in der Search Console auf „Indexierung“ und dann „Seiten“. Das Diagramm teilt die bekannten URLs in indexiert und nicht indexiert auf, und die Tabelle darunter gruppiert die nicht indexierten URLs nach Grund. Ein Klick auf einen Grund zeigt Beispiel-URLs.

Hier werden Muster sichtbar. Eine einzelne URL mit „Durch ‚noindex‘-Tag ausgeschlossen“ kann Absicht sein. Dreihundert davon in derselben Woche deuten auf ein Template. In diesem Bericht fällt dir auch auf, wenn ein ganzer Bereich unter „Gefunden – zurzeit nicht indexiert“ hängt. Der Nachteil ist das Timing: Die Daten werden nach Googles Zeitplan aktualisiert und hinken meist mehrere Tage hinterher. Wenn du eine Zeile findest, die Arbeit braucht, geht unser Leitfaden zum Beheben von Indexierungsfehlern in der GSC jeden Status durch.

Methode 4: Indexierbarkeit prüfen mit einem Crawler

Screaming Frog, Sitebulb und ähnliche Crawler können dir nicht sagen, was Google indexiert hat. Sie zeigen dir aber, ob jede Seite indexiert werden darf, indem sie das Meta-Robots-Tag, den HTTP-Header X-Robots-Tag, das Canonical und eine mögliche Sperre in der robots.txt auslesen. Auf einer Website mit Tausenden Seiten ist das oft der schnellste Weg, die Ursache hinter einer ganzen Gruppe von Ausschlüssen zu finden.

Der Haken: Es ist ein manueller Durchlauf. Er zeigt den Zustand an dem Tag, an dem du crawlst.

Häufige Gründe, warum eine Seite nicht indexiert ist

Eine noindex-Anweisung schließt du als Erstes aus. Sie kann im HTML als <meta name="robots" content="noindex"> stehen oder als Response-Header X-Robots-Tag: noindex kommen, der im Quelltext der Seite nicht zu sehen ist. Der noindex-Tag erklärt behandelt beide Varianten.

Ein Disallow in der robots.txt hindert Google daran, die Seite abzurufen. Seltsamerweise kann eine gesperrte Seite trotzdem ohne ihren Inhalt indexiert werden, wenn andere Websites auf sie verlinken. Eine Sperre ist also kein verlässlicher Weg, eine URL zu entfernen. Mehr dazu unter So prüfst du deine robots.txt.

Ein Canonical, das auf eine andere URL zeigt, sagt Google, dass diese Seite eine Kopie ist, und indexiert wird dann die andere URL.

Weniger auffällig ist ein Problem bei der Auffindbarkeit: Nichts verlinkt auf die Seite, und sie steht nicht in der XML-Sitemap, also hat Google sie nicht gefunden oder nicht priorisiert. „Gecrawlt – zurzeit nicht indexiert“ wiederum bedeutet, dass Google die Seite abgerufen und entschieden hat, sie nicht aufzunehmen, oft weil sie dünn wirkt oder einer anderen Seite zu ähnlich ist.

Die ersten drei Ursachen sind Konfigurationsfragen, die sich meist in wenigen Minuten beheben lassen. Die letzten beiden erfordern Arbeit an Inhalten und interner Verlinkung.

Warum ein einzelner Check nicht reicht

Ein Indexierungscheck zeigt dir den Zustand an dem Tag, an dem du ihn machst. Danach kann ein Plugin-Update ein noindex hinzufügen, eine Migration eine Staging-robots.txt mit Disallow: / in die Live-Umgebung kopieren oder eine CMS-Änderung die Canonicals auf den falschen Host zeigen lassen. Die Seite war indexiert, als du nachgesehen hast, und ist es jetzt nicht mehr. Die Search Console zeigt das erst, wenn Google neu gecrawlt und den Bericht aktualisiert hat.

Bei einer einzelnen Website, die du eng betreust, kannst du die Checks ab und zu wiederholen. Bei einem Portfolio von Kundenwebsites, auf denen andere Leute deployen, klappt das nicht. Deltio prüft die Seiten aus jeder Sitemap in einem täglichen Zyklus, liest das noindex-Tag und den Header, das Canonical und die robots.txt aus, erkennt URLs, die aus der Sitemap entfernt wurden, und schickt einen Alert per Slack oder E-Mail mit der Website und den betroffenen Seiten, sobald sich gegenüber der vorherigen Prüfung etwas geändert hat. Deltio meldet, dass eine Seite nicht mehr indexierbar ist, nicht, was Google schon daraus gemacht hat. Das Ergebnis bestätigst du weiterhin in der URL-Prüfung. Welche Änderungen einen Alert wert sind, erklärt der Beitrag zu SEO-Änderungsbenachrichtigungen.

Wenn das auf deinen eigenen Websites laufen soll, kannst du 14 Tage kostenlos testen.

Häufige Fragen

Wie lange dauert es, bis Google eine neue Seite indexiert?
Eine feste Zeit gibt es nicht. Seiten auf Websites, die Google häufig crawlt, können innerhalb von ein oder zwei Tagen indexiert sein, während neue oder selten aktualisierte Websites wochenlang warten. Ein Link von einer bereits indexierten Seite und ein Eintrag in der XML-Sitemap helfen Google, die Seite schneller zu finden.
Garantiert „Indexierung beantragen“ in der URL-Prüfung, dass die Seite indexiert wird?
Nein. Die URL landet mit einer gewissen Priorität in Googles Crawling-Warteschlange, aber Google entscheidet weiterhin selbst, ob sie indexiert wird. Trägt die Seite ein noindex, ist sie gesperrt oder wird sie als wenig wertvoll eingestuft, ändert der Antrag nichts am Ergebnis. Außerdem gibt es pro Property ein tägliches Limit für Anträge.
Kann eine per robots.txt gesperrte Seite trotzdem bei Google erscheinen?
Ja. Wenn andere Seiten auf sie verlinken, kann Google die URL indexieren, ohne sie zu crawlen, meist ohne Beschreibung im Suchergebnis. Um eine Seite aus den Ergebnissen herauszuhalten, erlaubst du das Crawling und setzt stattdessen ein noindex-Tag oder einen X-Robots-Tag-Header, denn Google muss die Seite abrufen, um das noindex zu sehen.
Wie prüfe ich die Indexierung bei einem PDF oder Bild statt einer HTML-Seite?
Die URL-Prüfung funktioniert für jede URL in deiner bestätigten Property, auch für PDFs. Da solche Dateien kein Meta-Robots-Tag enthalten können, wird ihre Indexierung über den HTTP-Header X-Robots-Tag gesteuert. Wenn ein PDF unerwartet ausgeschlossen oder aufgenommen wird, sieh dir also die Response-Header an.
Was bedeutet „Gefunden – zurzeit nicht indexiert“?
Google weiß, dass die URL existiert, meist über die Sitemap oder einen Link, hat sie aber noch nicht gecrawlt. Auf großen Websites deutet das oft auf die Crawling-Priorisierung hin. Bessere interne Links auf diese Seiten und das Entfernen wenig wertvoller URLs aus der Sitemap helfen hier in der Regel mehr als ein erneutes Einreichen.