glossário
noindex
A instrução que tira uma página do resultado de busca, dada por meta tag ou pelo cabeçalho X-Robots-Tag. Só funciona se o robô conseguir entrar para ler.
O que é
Existem dois jeitos de dizer noindex: a meta tag robots no HTML, e o cabeçalho HTTP X-Robots-Tag, que vale também para PDF e imagem.
O robô precisa rastrear a página para ver a instrução. Por isso uma página com noindex não pode estar bloqueada no robots.txt.
O cabeçalho é o mais perigoso dos dois, porque não aparece no código da página: um plugin ou uma regra de servidor pode tirar o site inteiro do Google sem ninguém ver.
O erro mais comum
Esquecer o noindex do ambiente de teste quando o site vai ao ar. É o motivo mais comum de site novo que não aparece em busca nenhuma.
Como o Indalo SEO mede isso no seu site
O rastreador lê as duas formas, a meta e o cabeçalho, marca a página como não indexável e baixa o peso dos defeitos dela na nota: defeito em página que o Google não mostra pesa um terço.
Fontes
Veja também
Agora no seu site.
O raio-x lê 25 páginas sem cadastro e mostra onde cada um destes termos aparece.