Três decisões diferentes
Robots.txt controla rastreamento, noindex pede exclusão dos resultados e canonical aponta a versão preferida de conteúdos iguais ou muito próximos.
Não esconda o noindex
Se robots.txt bloquear a página, o Google talvez não leia o noindex. Para remover uma página HTML do índice, normalmente permita o rastreamento.
Canonical não esconde página ruim
Ela consolida variantes, não substitui noindex. Links internos, redirecionamentos, canonical e Sitemap devem indicar a mesma URL final.
Checklist prático
- Definir o problema.
- Permitir leitura de noindex.
- Usar canonical em duplicatas.
- Excluir URLs não canônicas do Sitemap.