Em resumo: noindex é uma diretiva em meta robots ou no cabeçalho HTTP X-Robots-Tag que informa a um mecanismo de busca compatível para não exibir o conteúdo especificado nos resultados.
Como uso noindex na prática
Não uso noindex apenas como mais um número em uma apresentação. Primeiro decido qual decisão ele deve esclarecer, quais dados ou observações a sustentam e quem agirá com base no resultado. Verifico o HTML final ou o cabeçalho na URL ativa e permito o acesso do crawler para que ele possa ler a diretiva. Também registro o estado inicial, a data da medição e os limites da interpretação. Assim, é possível distinguir uma mudança real de uma mudança na ferramenta, na amostra ou na redação.
O que observar
O maior risco é a precisão aparente. Um bloqueio simultâneo de robots.txt pode impedir que um crawler leia noindex; remover uma URL do sitemap, por si só, não impede a indexação. Compare o resultado ao longo do tempo, em uma amostra estável e junto do contexto comercial. Se o termo não levar a um próximo passo concreto, ele criou apenas mais um rótulo.
Perguntas para decisões
- O crawler consegue buscar a URL?
- A diretiva está presente na resposta final após os redirecionamentos?
- Um 404 ou 410 seria mais apropriado?
- A navegação principal contém um link para a página noindex?