Kurz-Fakten

  • Crawling und Indexierung sind zwei getrennte Schritte
  • Steuerbar über das Robots-Meta-Tag, nicht über die robots.txt
  • Suchmaschinen nehmen nicht jede erreichbare Seite auf
  • Prüfbar in der Search Console je einzelner Adresse

Bedeutung in der Praxis

Der zweite Punkt ist die häufigste Verwechslung überhaupt: Eine per robots.txt gesperrte Seite kann trotzdem im Index landen – ohne dass die Suchmaschine ihren Inhalt kennt. Wer eine Seite sicher heraushalten will, lässt sie crawlen und setzt noindex.

Wenn Seiten nicht aufgenommen werden, liegt es meist an dünnem oder doppeltem Inhalt, nicht an einem technischen Fehler.

Verwandte Begriffe