Extrator de Links Internos

Cole uma URL ou HTML bruto e o extrator puxa cada tag âncora, separando internas (mesmo host) de externas, anotando texto âncora, atributos rel, alvo, status nofollow e a posição no documento. Útil para auditorias de SEO, busca de páginas órfãs e identificação de rel="nofollow" inadvertido em links internos importantes.

Como extrair links internos

  1. 1

    Insira uma URL ou cole HTML

    Para uma URL ao vivo, a ferramenta busca e analisa o DOM. HTML colado é analisado localmente no seu navegador.

  2. 2

    Veja a tabela de links

    URL de destino, texto âncora, rel, alvo, flag nofollow e posição do link (cabeçalho / corpo / rodapé).

  3. 3

    Filtrar apenas internos

    Ative o filtro "apenas internos" para ocultar links que saem do host atual.

  4. 4

    Exportar

    Copie como CSV ou JSON para uso em um rastreador ou auditoria de planilha.

Por que links internos são importantes para SEO

Links internos fazem três coisas que o Google se importa:

  1. Descoberta de rastreamento. Bots alcançam novas páginas seguindo links de páginas que já conhecem.
  2. Distribuição de PageRank. Cada link interno passa uma parte da autoridade da página de origem. Páginas-chave merecem mais links internos recebendo.
  3. Relevância contextual. O texto âncora e o parágrafo ao redor informam ao Google sobre o que a página de destino trata.

O que a ferramenta sinaliza

Sinal Significado
Interno / Externo Comparado com o host da página (incluindo subdomínios).
Nofollow rel="nofollow" presente, nenhum sinal de classificação passado.
Patrocinado / UGC rel="sponsored" ou rel="ugc", mesmo comportamento de rastreamento.
Alvo em branco target="_blank", abre em uma nova aba.
Âncora vazia Sem texto visível (apenas imagem ou espaço em branco).
Apenas hash Links de fragmento como #section, não cruzam páginas.
Posição Cabeçalho / nav / conteúdo principal / rodapé.

Corrigindo problemas comuns que o extrator revela

  • Nofollows internos no nav. Às vezes, um template aplica rel="nofollow" a cada link interno, remova esses.
  • Âncoras de correspondência exata excessivas. Se 40 links internos apontam para /blog/pricing com a âncora “pricing”, isso pode parecer manipulativo.
  • Páginas órfãs. Rastreie todo o site e verifique quais URLs não têm links internos apontando para elas.
  • Âncoras apenas de imagem. <a><img alt="..."></a> é aceitável, mas o Google lê o texto alt como âncora, certifique-se de que seja significativo.

Quando usar busca de URL vs HTML colado

  • Use a busca de URL para páginas públicas e auditorias rápidas.
  • Use HTML colado para páginas autenticadas (sites de staging atrás de autenticação HTTP Básica), SPAs dinâmicas após renderização JavaScript, ou análise offline de uma página baixada.

Erros comuns

  • Tratar links de subdomínio como externos. Motores de busca geralmente fazem isso, blog em blog.example.com vs site principal em example.com distribuem autoridade separadamente.
  • Faltando elementos <link> (canônico, alternativo). Esses não estão cobertos aqui; contam como referências internas, mas são semanticamente diferentes de âncoras.
  • Confundir rel="noopener" com rel="nofollow". O primeiro é um atributo de segurança; não afeta SEO.

Perguntas frequentes

Uma âncora cujo host de destino corresponde ao host da página atual. Por padrão, subdomínios são tratados como externos; ative “incluir subdomínios” para contá-los como internos para auditorias de marca única.

Quando você busca uma URL, não, ela analisa a resposta HTML bruta. Para SPAs renderizadas em JavaScript, abra a página, veja o código-fonte após o carregamento e cole a marcação DOM na ferramenta.

Não via busca de URL (o servidor responde com uma página de login). Faça login, copie o HTML renderizado e cole na ferramenta para análise local.

Sim. Copie como CSV para trabalho em planilhas ou JSON para alimentar em um script, com uma linha por link incluindo URL, texto âncora, rel e posição.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas