Kurz-Fakten
- Vorgabe ohne Angabe ist index, follow – das Element ist dann überflüssig
- Anweisungen lassen sich kombinieren: content="noindex, nofollow"
- Statt für alle Suchmaschinen lässt sich gezielt eine ansprechen, etwa name="googlebot"
- Dieselben Anweisungen können als HTTP-Kopfzeile X-Robots-Tag gesendet werden – nötig bei PDF und Bildern
- Sperre in der robots.txt und noindex schließen sich gegenseitig aus: gesperrte Seiten werden nicht gelesen
Einordnung für die Praxis
Der Widerspruch zwischen Sperre und noindex ist der häufigste Fehler beim Ausschließen von Seiten. Wer eine Adresse wirklich aus dem Index bekommen will, muss den Abruf erlauben und noindex setzen – bis die Suchmaschine es gesehen hat. Erst danach darf gesperrt werden, wenn überhaupt.
Bei einem Umzug lohnt außerdem ein Blick auf die Voreinstellung des Systems: Eine Entwicklungsfassung, die versehentlich mit noindex live geht, kostet Wochen – und fällt oft erst auf, wenn die Zugriffe ausbleiben.