Mörfelden-Walldorf & Rhein-Main

Indexierung

Kurz und knapp

Indexierung heißt, dass Google eine Seite in seinen Bestand aufgenommen hat. Erst danach kann sie überhaupt in den Suchergebnissen erscheinen.

Was bedeutet Indexierung?

Bevor eine Seite bei Google auftauchen kann, muss sie zwei Schritte durchlaufen. Zuerst findet und lädt ein Programm die Seite, das nennt sich Crawling. Danach entscheidet Google, ob die Seite in den Index aufgenommen wird. Nur indexierte Seiten können ranken.

Ob eine Seite im Index ist, siehst Du in der Google Search Console unter „Seiten“. Dort steht auch, warum eine Seite fehlt: gesperrt durch robots.txt, auf noindex gesetzt, als Duplikat eingestuft oder schlicht als nicht wichtig genug bewertet.

Gesteuert wird das über wenige Stellschrauben: die Datei robots.txt, das Meta-Tag noindex, die Sitemap und die interne Verlinkung. Seiten, auf die nichts verweist, werden seltener besucht und fallen leichter heraus.

Nicht jede Seite gehört in den Index. Danke-Seiten, Filterergebnisse und Druckansichten sind typische Kandidaten für noindex. Mehr zu den technischen Grundlagen steht unter Technisches SEO.

Beispiel

Nach einem Relaunch war eine Website drei Wochen lang unsichtbar. Grund war ein noindex aus der Entwicklungsumgebung, das beim Livegang mitgewandert war. Eine Zeile, die den gesamten Auftritt aus dem Index genommen hatte.

Crawling, Indexierung und Ranking auseinanderhalten

Crawling ist das Abholen. Ein Programm folgt Links, lädt Seiten herunter und sieht nach, ob sich etwas geändert hat. Wie oft das passiert, hängt davon ab, wie wichtig Google eine Website einschätzt.

Indexierung ist die Aufnahme. Google verarbeitet die Seite, versteht ihren Inhalt und legt sie ab. Erst jetzt kann sie überhaupt erscheinen.

Ranking ist die Auswahl im Moment der Suche. Aus dem Index wird für jede Anfrage neu sortiert, siehe Ranking.

Diese Reihenfolge erklärt viele Missverständnisse. Eine Seite, die nicht rankt, ist nicht automatisch nicht indexiert. Und eine indexierte Seite rankt nicht automatisch.

Die Stellschrauben im Einzelnen

robots.txt steuert das Crawling, nicht die Indexierung. Eine dort gesperrte Seite kann trotzdem im Index landen, wenn andere Seiten auf sie verlinken, dann allerdings ohne Beschreibung.

noindex als Meta-Angabe im Quelltext verhindert die Aufnahme zuverlässig. Wichtig: Die Seite muss dafür crawlbar sein. Wer sie gleichzeitig in der robots.txt sperrt, verhindert, dass Google das noindex überhaupt sieht.

Canonical sagt, welche von mehreren gleichen oder ähnlichen Adressen die maßgebliche ist. Typischer Anwendungsfall sind Filter, Sortierungen und Adressen mit UTM-Parametern.

Interne Links sind das unterschätzteste Mittel. Eine Seite, auf die nichts verweist, wird selten besucht und fällt leichter wieder heraus.

Die häufigsten Statusmeldungen in der Search Console

Gecrawlt, zurzeit nicht indexiert: Google kennt die Seite, hält sie aber nicht für wichtig genug. Meist liegt es an dünnem oder doppeltem Inhalt.

Gefunden, zurzeit nicht indexiert: Google kennt die Adresse, hat sie aber noch nicht abgeholt. Das trifft oft viele Seiten auf einmal und deutet auf zu viele unwichtige Adressen hin.

Alternative Seite mit richtigem kanonischen Tag: kein Fehler, sondern die gewünschte Wirkung eines Canonical.

Duplikat, Google hat eine andere Seite als kanonisch bestimmt: hier lohnt ein Blick. Google hat sich gegen Deine Angabe entschieden, meist weil zwei Seiten sich zu ähnlich sind.

Worauf es ankommt

  • Nach jedem Livegang prüfen. Der häufigste schwere Fehler ist ein vergessenes noindex.
  • Wichtige Seiten verlinken. Was nur über die Sitemap erreichbar ist, wird nachrangig behandelt.
  • Dünne Seiten vermeiden. Seiten ohne eigenen Inhalt werden oft gar nicht erst aufgenommen.
  • Eine Adresse je Inhalt. Mehrere Adressen für dieselbe Seite führen zu Duplikaten im Index.

Häufige Fehler

  • robots.txt und noindex verwechseln. Eine per robots.txt gesperrte Seite kann Google nicht lesen und das noindex darin nie sehen.
  • Alte Adressen nach einem Umzug ohne Weiterleitung löschen.
  • Erwarten, dass eine neue Seite am selben Tag erscheint.

Häufige Fragen

Wie lange dauert die Indexierung?
Bei einer etablierten Website oft wenige Tage, bei einer neuen Domain auch mehrere Wochen. Über die Search Console lässt sich eine einzelne Adresse zur Prüfung einreichen, das beschleunigt es in vielen Fällen.
Wie finde ich heraus, ob meine Seite im Index ist?
Am zuverlässigsten über die URL-Prüfung in der Search Console. Die Suche mit site: zeigt nur einen groben Ausschnitt und ist für genaue Aussagen nicht geeignet.
Muss jede Seite in den Index?
Nein. Bestätigungsseiten, interne Suchergebnisse und Seiten ohne eigenen Inhalt gehören bewusst nicht hinein. Ein kleiner, sauberer Index ist besser als ein großer voller Dubletten.

Verwandte Begriffe

Noch Fragen zu Indexierung?

30 Minuten, kostenlos und unverbindlich. Ich erkläre Dir, was der Begriff für Dein Projekt konkret bedeutet.