SEO-Tools
Indexierbarkeits-Checker: Kann Google diese Seite indexieren?
Prüft jedes Signal, das darüber entscheidet, ob eine Seite in den Index darf: Statuscode, Zugriff laut robots.txt, Meta-Robots, den X-Robots-Tag-Header und das Canonical.
Was „indexierbar“ hier bedeutet
Dieses Tool beantwortet, ob eine Seite Indexierung zulässt, nicht ob Google sie indexiert hat. Das sind zwei verschiedene Fragen, und nur die erste lässt sich von außen beantworten: Ob Google eine URL tatsächlich indexiert hat, sehen Sie nur in der Search Console einer Property, die Ihnen gehört.
Der Unterschied zählt, weil beide Fälle aus Sicht der Suchergebnisse identisch aussehen. Eine Seite kann einwandfrei indexierbar und trotzdem nicht in der Suche sein, weil Google sie nicht für indexierungswürdig hielt — kein externes Tool kann das von einer technischen Blockade unterscheiden.
Die Signale in der Reihenfolge, in der Google sie auswertet
Lesen Sie sie in genau dieser Reihenfolge. Ein früher Fehlschlag macht alles Weitere gegenstandslos — und genau deshalb lässt sich eine in der robots.txt gesperrte URL nicht per noindex aus dem Index nehmen: Der Crawler kommt nie weit genug, um es zu lesen.
- Statuscode — eine Antwort ungleich 200 beendet die Frage sofort.
- robots.txt — ist der Pfad gesperrt, wird die Seite nie abgerufen und ihre Direktiven nie gesehen.
- Meta-Robots — ein noindex im Head, das überhaupt nur nach einem erfolgreichen Crawl gelesen wird.
- X-Robots-Tag — dieselbe Direktive auf Header-Ebene, leicht zu übersehen, weil im HTML unsichtbar.
- Canonical — ein Canonical, das woandershin zeigt, bittet Google, die andere URL zu indexieren.
Wenn alles besteht und die Seite trotzdem fehlt
Diese Kombination ist häufig und führt vollständig von der Konfiguration weg. „Gefunden – zurzeit nicht indexiert“ bedeutet, dass Google anders priorisiert hat, meist weil die Seite dünn, nahezu doppelt oder schwach verlinkt ist. Arbeiten Sie weiter mit der Indexierbarkeits-Diagnose.
- Sagt mir das, ob meine Seite in Google ist?
- Nein, und kein anderes externes Tool sagt das zuverlässig. Es zeigt, ob die Seite Indexierung zulässt. Ob Google sie indexiert hat, sehen Sie in der Search Console Ihrer eigenen Property.
- Die Seite ist indexierbar, erscheint aber nicht. Warum?
- Indexierbarkeit ist eine Erlaubnis, kein Verdienst. Google entscheidet weiterhin, ob eine Seite den Index wert ist, und dünne oder nahezu doppelte Seiten werden regelmäßig gecrawlt und dann übergangen.
Weitere Tools
Ruft die robots.txt des eingegebenen Hosts ab, meldet, ob sie existiert und ob sie alle Crawler blockiert, und liest parallel die Robots-Direktiven auf Seitenebene.
Sucht die Sitemap so, wie ein Crawler es tut — zuerst die Deklaration in der robots.txt, dann die üblichen Orte — und prüft anschließend, ob das Dokument als XML parst, und zählt die enthaltenen URLs.
Liest die von der Seite deklarierte kanonische URL und ruft diese Adresse anschließend ab, um zu bestätigen, dass sie erreichbar ist, nicht weiterleitet und kein noindex trägt — die drei Wege, auf denen ein Canonical still wirkungslos wird.
Analysiert die strukturierten Daten der eingegebenen Seite, listet die gefundenen schema.org-Typen auf und markiert Blöcke, die nicht parsen oder denen die von ihrem Typ verlangten Eigenschaften fehlen.
Folgt der eingegebenen URL über jeden Schritt und meldet den Statuscode jeder Station sowie das endgültige Ziel — genau das Detail, das der Browser verbirgt, sobald die Adresszeile zur Ruhe kommt.