Kurz-Fakten

  • Liegt unter /robots.txt, gilt nur für die eigene Domain
  • Steuert Abruf, nicht Indexierung – dafür ist noindex zuständig
  • Steuerung erfolgt je benanntem User-Agent
  • Wird von unseriösen Crawlern schlicht ignoriert

Bedeutung in der Praxis

Wer eine Seite sicher aus dem Index halten will, darf sie nicht per robots.txt sperren, sondern muss sie crawlen lassen und noindex setzen. Andernfalls sieht die Suchmaschine die Anweisung nie.

Zweiter Punkt mit wachsender Bedeutung: In vielen Systemen sind AI-Crawler als Nebenwirkung einer Voreinstellung mitgesperrt. Wer in KI-Antworten vorkommen will, sollte das prüfen – nicht annehmen.

Verwandte Begriffe