Verificador de Indexabilidade

Verificar indexabilidade
Próximo

Uma página pode ser perfeitamente boa, mas invisível para a pesquisa porque uma única tag diz “noindex” ou o robots.txt bloqueia o rastreador. Cole uma URL e este verificador avalia cada sinal que o Google usa, robots.txt, meta robots, cabeçalho X-Robots-Tag, alvo canônico, status HTTP, e informa se a página é indexável, por quê e o que mudar se não for.

Como verificar a indexabilidade

  1. 1

    Insira uma URL

    O verificador busca a URL como o Googlebot faria.

  2. 2

    Ele resolve redirecionamentos

    Uma cadeia de redirecionamentos 301/302 é rastreada; a URL final é a que é avaliada.

  3. 3

    Ele lê cada sinal de indexabilidade

    regras do robots.txt, meta robots, X-Robots-Tag, canônico, código de status.

  4. 4

    Veredicto e razão

    Indexável / não indexável / parcial, com o sinal exato que causou o veredicto.

Sinais de indexabilidade e sua precedência

O Google avalia um conjunto de sinais em uma ordem específica; um único negativo na cadeia é suficiente para bloquear a indexação.

Ordem de avaliação de sinais

  1. Status HTTP: 2xx necessário. Cadeias 3xx são seguidas; 4xx e 5xx encerram a indexação.
  2. robots.txt: se a URL for proibida para o Googlebot, a página nunca é rastreada, o que significa que as tags noindex nela nunca são vistas.
  3. Cabeçalho X-Robots-Tag: noindex nos cabeçalhos de resposta HTTP bloqueia a indexação.
  4. Meta robots: <meta name="robots" content="noindex"> bloqueia a indexação.
  5. Canônico: um canônico apontando para outro lugar significa que o Google indexa essa outra URL em vez disso.
  6. Qualidade do conteúdo e detecção de duplicatas: o Google pode pular a indexação mesmo sem diretrizes explícitas.

Erros comuns que isso captura

Problema Causa
Toda a seção não indexada Regra Disallow: no robots.txt
Página específica não indexada noindex em meta robots
Indexada com URL errada Canônico aponta para outro lugar
Preso em 5xx Erro de servidor quebra o rastreamento
Conflito de Disallow + noindex Robots.txt bloqueia o rastreamento, tag noindex nunca lida
Vazamentos de staging para produção X-Robots-Tag: noindex sobrando de um ambiente de teste

A armadilha do robots.txt + noindex

Se você Disallow: uma URL no robots.txt, o Google nunca a rastreia, então nunca vê nenhuma tag noindex. A URL ainda pode aparecer nos resultados de pesquisa como uma entrada “em branco” com apenas a URL e sem descrição. Para remover uma URL do índice corretamente, permita o rastreamento e use noindex, depois bloqueie o rastreamento apenas depois que o Google a tiver desindexado.

Testando do ponto de vista do Googlebot

O verificador envia o agente do usuário Googlebot, então quaisquer truques do lado do servidor “rastreador só vê X” são visíveis. Sempre verifique URLs de produção, não de staging.

Perguntas frequentes

Ser indexável apenas significa que não há bloqueio técnico; não garante indexação. O Google também decide com base na qualidade percebida, conteúdo duplicado e orçamento de rastreamento. Use a Inspeção de URL do Search Console para uma resposta definitiva do próprio Google.

Normalmente, apenas meta robots (ou X-Robots-Tag) é a resposta certa. Robots.txt bloqueia o rastreamento; meta robots bloqueia a indexação. Para páginas que você não deseja indexar, permita o rastreamento para que o Google possa ler sua tag noindex.

O Google avalia o destino final de uma cadeia de redirecionamento. Um 301 de A para B significa que o Google indexa B, não A. O verificador simula isso resolvendo todos os redirecionamentos antes de avaliar.

Não. Páginas que requerem autenticação não são indexáveis por definição. Se você precisar de SEO para elas, considere uma versão de pré-visualização pública.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas