Drei Probleme brauchen drei Signale
Robots.txt steuert das Crawling, noindex die Aufnahme in Suchergebnisse und Canonical die bevorzugte Version sehr ähnlicher Inhalte.
Noindex nicht vor dem Crawler verstecken
Blockiert robots.txt die Seite, sieht Google möglicherweise das noindex nicht. Soll eine normale HTML-Seite aus dem Index, muss sie meist crawlbar bleiben.
Canonical versteckt keine schlechte Seite
Canonical bündelt Varianten und ersetzt noindex nicht. Interne Links, Weiterleitungen, Canonicals und Sitemap sollten auf dieselbe Ziel-URL zeigen.
Praktische Checkliste
- Problem benennen.
- Noindex lesbar halten.
- Canonical nur für Varianten.
- Nichtkanonische URLs aus Sitemap nehmen.