Was bedeutet Indexierung?
Bevor eine Seite bei Google auftauchen kann, muss sie zwei Schritte durchlaufen. Zuerst findet und lädt ein Programm die Seite, das nennt sich Crawling. Danach entscheidet Google, ob die Seite in den Index aufgenommen wird. Nur indexierte Seiten können ranken.
Ob eine Seite im Index ist, siehst Du in der Google Search Console unter „Seiten“. Dort steht auch, warum eine Seite fehlt: gesperrt durch robots.txt, auf noindex gesetzt, als Duplikat eingestuft oder schlicht als nicht wichtig genug bewertet.
Gesteuert wird das über wenige Stellschrauben: die Datei robots.txt, das Meta-Tag noindex, die Sitemap und die interne Verlinkung. Seiten, auf die nichts verweist, werden seltener besucht und fallen leichter heraus.
Nicht jede Seite gehört in den Index. Danke-Seiten, Filterergebnisse und Druckansichten sind typische Kandidaten für noindex. Mehr zu den technischen Grundlagen steht unter Technisches SEO.
Nach einem Relaunch war eine Website drei Wochen lang unsichtbar. Grund war ein noindex aus der Entwicklungsumgebung, das beim Livegang mitgewandert war. Eine Zeile, die den gesamten Auftritt aus dem Index genommen hatte.
Crawling, Indexierung und Ranking auseinanderhalten
Crawling ist das Abholen. Ein Programm folgt Links, lädt Seiten herunter und sieht nach, ob sich etwas geändert hat. Wie oft das passiert, hängt davon ab, wie wichtig Google eine Website einschätzt.
Indexierung ist die Aufnahme. Google verarbeitet die Seite, versteht ihren Inhalt und legt sie ab. Erst jetzt kann sie überhaupt erscheinen.
Ranking ist die Auswahl im Moment der Suche. Aus dem Index wird für jede Anfrage neu sortiert, siehe Ranking.
Diese Reihenfolge erklärt viele Missverständnisse. Eine Seite, die nicht rankt, ist nicht automatisch nicht indexiert. Und eine indexierte Seite rankt nicht automatisch.
Die Stellschrauben im Einzelnen
robots.txt steuert das Crawling, nicht die Indexierung. Eine dort gesperrte Seite kann trotzdem im Index landen, wenn andere Seiten auf sie verlinken, dann allerdings ohne Beschreibung.
noindex als Meta-Angabe im Quelltext verhindert die Aufnahme zuverlässig. Wichtig: Die Seite muss dafür crawlbar sein. Wer sie gleichzeitig in der robots.txt sperrt, verhindert, dass Google das noindex überhaupt sieht.
Canonical sagt, welche von mehreren gleichen oder ähnlichen Adressen die maßgebliche ist. Typischer Anwendungsfall sind Filter, Sortierungen und Adressen mit UTM-Parametern.
Interne Links sind das unterschätzteste Mittel. Eine Seite, auf die nichts verweist, wird selten besucht und fällt leichter wieder heraus.
Die häufigsten Statusmeldungen in der Search Console
Gecrawlt, zurzeit nicht indexiert: Google kennt die Seite, hält sie aber nicht für wichtig genug. Meist liegt es an dünnem oder doppeltem Inhalt.
Gefunden, zurzeit nicht indexiert: Google kennt die Adresse, hat sie aber noch nicht abgeholt. Das trifft oft viele Seiten auf einmal und deutet auf zu viele unwichtige Adressen hin.
Alternative Seite mit richtigem kanonischen Tag: kein Fehler, sondern die gewünschte Wirkung eines Canonical.
Duplikat, Google hat eine andere Seite als kanonisch bestimmt: hier lohnt ein Blick. Google hat sich gegen Deine Angabe entschieden, meist weil zwei Seiten sich zu ähnlich sind.
Worauf es ankommt
- Nach jedem Livegang prüfen. Der häufigste schwere Fehler ist ein vergessenes noindex.
- Wichtige Seiten verlinken. Was nur über die Sitemap erreichbar ist, wird nachrangig behandelt.
- Dünne Seiten vermeiden. Seiten ohne eigenen Inhalt werden oft gar nicht erst aufgenommen.
- Eine Adresse je Inhalt. Mehrere Adressen für dieselbe Seite führen zu Duplikaten im Index.
Häufige Fehler
- robots.txt und noindex verwechseln. Eine per robots.txt gesperrte Seite kann Google nicht lesen und das noindex darin nie sehen.
- Alte Adressen nach einem Umzug ohne Weiterleitung löschen.
- Erwarten, dass eine neue Seite am selben Tag erscheint.
Häufige Fragen
Wie lange dauert die Indexierung?
Wie finde ich heraus, ob meine Seite im Index ist?
Muss jede Seite in den Index?
Verwandte Begriffe
Sitemap
Eine Sitemap ist ein Verzeichnis aller Seiten einer Website. Sie hilft Suchmaschinen dabei, nichts zu übersehen.
SEOSEO
SEO ist die Arbeit daran, dass eine Website bei Google zu den passenden Suchanfragen erscheint, und zwar ohne für jeden Klick zu bezahlen.
SEOCore Web Vitals
Die Core Web Vitals sind drei Messwerte von Google für Ladezeit, Reaktion und Stabilität einer Seite beim Laden.
Web & Design