Indexierung (engl. Indexing; Aufnahme in den Suchindex)
Wie funktioniert Indexierung bei Suchmaschinen?
Ihre Seite ist online, Google hat sie besucht, und trotzdem taucht sie in keiner Suche auf. Meistens hakt es dann nicht am Abruf, sondern an der Indexierung.
Indexierung ist der Vorgang, mit dem eine Suchmaschine eine abgerufene Webseite verarbeitet und in ihren Suchindex aufnimmt. Nach dem Crawling analysiert Google den Inhalt, rendert die Seite, ordnet sie thematisch ein und speichert sie. Erst danach kann sie überhaupt zu einer Suchanfrage erscheinen. Indexierung ist damit der zweite entscheidende Schritt zwischen dem reinen Abruf einer Seite und ihrem Ranking.
Für die Suchmaschinenoptimierung ist die Unterscheidung zwischen Crawling und Indexierung zentral, denn eine Seite kann gecrawlt und trotzdem nicht indexiert sein. Als Teil des technischen SEO geht es darum, wichtige Seiten sicher aufzunehmen und unwichtige bewusst fernzuhalten. Nur eine indexierte Seite kann Sichtbarkeit erzeugen, alles andere bleibt für die Suche wirkungslos.
Vom Crawling zur Aufnahme in den Index
Nach dem Crawling durchläuft eine Seite mehrere Verarbeitungsschritte. Google liest den HTML-Code, führt gegebenenfalls JavaScript aus (Rendering) und erfasst so den tatsächlich sichtbaren Inhalt. Anschließend wertet die Suchmaschine Texte, Bilder, Metadaten und strukturierte Auszeichnungen aus und ordnet der Seite Themen und Signale zu. Das Ergebnis landet im Suchmaschinenindex, der riesigen Datenbank, aus der Google seine Ergebnisse zusammenstellt.
Der entscheidende Punkt: Nicht jede gecrawlte Seite wird aufgenommen. Google entscheidet anhand von Qualität, Einzigartigkeit und Relevanz, ob eine URL indexiert wird. Dünne, doppelte oder wenig hilfreiche Inhalte bleiben bewusst außen vor, in der Search Console erkennbar am Status „Gecrawlt – zurzeit nicht indexiert".
Indexierbarkeit steuern: noindex, canonical, robots.txt
Ob eine Seite überhaupt in Frage kommt, beschreibt ihre Indexierbarkeit. Gesteuert wird sie über mehrere Signale, die in der Praxis ständig verwechselt werden:
- Meta-Robots „noindex": Die verlässlichste Anweisung, eine Seite nicht zu indexieren. Über das Noindex-Tag schließen Sie etwa Danke-Seiten oder Filterseiten gezielt aus.
- Canonical: Kein Ausschluss, sondern ein Hinweis, welche von mehreren ähnlichen URLs die maßgebliche ist – zur Bündelung doppelter Inhalte.
- robots.txt: Steuert das Crawling, nicht die Indexierung. Sie ist der falsche Hebel, um eine Seite aus dem Index zu halten.
Daraus folgt ein Zusammenhang, an dem viele scheitern: Eine Seite, die per robots.txt blockiert ist, kann ihre Noindex-Anweisung gar nicht übermitteln, weil Google den Seiteninhalt nie abruft. Wer eine Seite zuverlässig deindexieren will, muss das Crawling erlauben und per noindex ausschließen, nie beides gleichzeitig sperren.
Indexierung prüfen und beschleunigen
Den aktuellen Status einer Seite sehen Sie in der Google Search Console über die URL-Prüfung; dort melden Sie eine Seite auch zur Indexierung an. Eine gepflegte XML-Sitemap hilft Google, neue und geänderte Inhalte schneller zu finden. Eine Garantie für die Aufnahme gibt es trotzdem nicht, die Entscheidung trifft immer die Suchmaschine anhand der wahrgenommenen Qualität.
Das ist am Ende die eine Faustregel, die zählt: Crawling bringt Google zur Seite, Indexierung bringt die Seite in die Suche. Beide Ebenen müssen widerspruchsfrei zusammenspielen. Konkret heißt das: Wichtige Seiten wollen indexiert werden und liefern eigenständige, gute Inhalte; unwichtige hält man per noindex draußen (nicht per robots.txt); und Crawling-Sperre und noindex schließen sich gegenseitig aus. Wo Sie unsicher sind, geben Search Console und XML-Sitemap den Indexstatus prüf- und steuerbar zurück.
Unterstützung beim Index-Management
Ob zu viele unwichtige Seiten im Index liegen oder wichtige fehlen: Indexierungsprobleme kosten Sichtbarkeit und sind ohne saubere Analyse schwer zu greifen. mindtwo prüft Indexabdeckung und Steuerungssignale und sorgt dafür, dass genau die richtigen Seiten in der Suche stehen. Angebot anfragen, wenn Ihr Index-Management verlässlich sitzen soll.
Weiterführende Themen zur Indexierung
- Woraus der Index besteht: der Suchmaschinenindex
- Wann eine Seite aufgenommen werden kann: die Indexierbarkeit
- Seiten gezielt ausschließen mit Noindex
- Der Schritt davor: das Crawling
- Die Indexierung in der Praxis steuern: der Blog-Beitrag Indexierung richtig steuern
Können wir weiterhelfen?
Sie haben ein spannendes Projekt und möchten mit uns zusammenarbeiten? Kontaktieren Sie uns jetzt!
Digitaler Erfolg? Ein Klick entfernt.
Unser Angebot ist so vielseitig wie die digitale Welt selbst. Von Webentwicklung bis hin zu strategischer Beratung bieten wir Ihnen ein Rundum-Paket für Ihren digitalen Erfolg. Entdecken Sie jetzt Ihre Möglichkeiten.
Erstgespräch vereinbaren
Vereinbaren Sie einen unverbindlichen und kostenlosen Beratungstermin und stellen Sie uns Ihr Projekt vor.