Extrator de Metadados

Insira uma URL e o extrator busca a página, analisa o <head> e apresenta tudo que importa para como seu link aparece em outros lugares: o título SEO e a descrição meta, a URL canônica, tags Open Graph que o Facebook e o LinkedIn usam para prévias de links, tags do Twitter Card, favicon e ícones de aplicativos, dados estruturados JSON-LD (Schema.org, Artigo, Produto, FAQ). Útil para auditorias de SEO, depuração de prévias de links e verificação do que uma página recém-publicada realmente expõe para crawlers.

Como os metadados são extraídos

  1. 1

    Insira a URL

    URL completa incluindo o protocolo. A ferramenta segue um redirecionamento.

  2. 2

    A página é buscada no lado do servidor

    O HTML bruto é analisado; páginas renderizadas em JavaScript podem não expor metadados do lado do cliente.

  3. 3

    Seções agrupadas por padrão

    SEO, Open Graph, Twitter, Schema.org, ícones, mobile, PWA.

  4. 4

    Cada entrada mostra valor e comprimento

    Títulos e descrições recebem avisos de comprimento se excederem os limites do Google ou Twitter.

  5. 5

    Prévia do cartão de link

    Renderiza um cartão de compartilhamento simulado do Facebook / LinkedIn / Twitter a partir das tags extraídas.

O que há no <head> que importa

SEO Básico

Tag Propósito
<title> Aba do navegador, título do resultado do Google
<meta name="description"> Trecho do resultado do Google, fallback social
<link rel="canonical"> URL canônica, sinal de conteúdo duplicado
<meta name="robots"> index/noindex, regras follow/nofollow
<meta name="viewport"> Viewport móvel

Open Graph (Facebook, LinkedIn, Discord, Slack)

Tag Propósito
og:title Título do cartão de compartilhamento
og:description Descrição do cartão de compartilhamento
og:image Imagem do cartão de compartilhamento (1200×630 recomendado)
og:type website / article / video.other
og:url URL canônica para o compartilhamento
og:site_name Nome do site exibido no cartão

Twitter Card

Tag Propósito
twitter:card summary / summary_large_image
twitter:title Reverte para og:title
twitter:description Reverte para og:description
twitter:image Cartão de imagem grande
twitter:site / twitter:creator Perfis do editor / autor

Schema.org (JSON-LD)

<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Article",
  "headline": "...",
  "author": { "@type": "Person", "name": "..." },
  "datePublished": "2026-04-18"
}
</script>

Artigo, Produto, Receita, FAQ, Evento, Organização, Breadcrumb são os mais impactantes para resultados ricos de busca.

Sinais de alerta em uma auditoria

  • Faltando og:image. Seus links parecem nus quando compartilhados no Slack ou Discord.
  • Título com mais de 60 caracteres. Truncado nos resultados de busca do Google.
  • Descrição com mais de 160 caracteres. Truncado no trecho do Google.
  • Sem tag canônica. Risco de confusão de classificação de conteúdo duplicado entre /page e /page/.
  • Faltando tanto og:image quanto twitter:image. Nenhum cartão de prévia social é renderizado.
  • noindex em uma página que deveria classificar. Acontece o tempo todo em servidores de staging que foram ao ar sem remover a tag.

Fluxo de trabalho de depuração

  1. Extraia primeiro na URL de staging.
  2. Verifique a URL ao vivo após a implantação.
  3. Limpe o cache do scraper do Facebook (Sharing Debugger) e o validador de cartões do Twitter após uma mudança, eles armazenam em cache agressivamente.
  4. Teste em uma janela anônima caso um cookie de login revele conteúdo diferente.

Perguntas frequentes

Parcialmente. O extrator busca o HTML renderizado no servidor. Se suas tags meta forem injetadas por JavaScript do lado do cliente (frameworks SPA sem SSR), elas não aparecerão, que é também como o Google vê a página sem execução de JavaScript na primeira busca.

Causas comuns: a URL está atrás de um login, a imagem é muito pequena (< 200×200), ou o Facebook armazenou em cache uma versão mais antiga. Limpe o cache no Sharing Debugger e tente novamente.

Ajuda para tipos de conteúdo específicos (Artigo, Produto, Receita, FAQ, Breadcrumb) porque o Google o usa para resultados ricos. Páginas de marketing genéricas não precisam. Adicione schema quando o tipo de conteúdo tiver um formato de resultado rico associado.

<link rel="canonical"> diz aos motores de busca qual versão de uma página indexar. og:url diz às plataformas sociais qual URL o compartilhamento representa. Geralmente são idênticos, mas não precisam ser.

Através de um buscador do lado do servidor, seu navegador não pode buscar URLs externas arbitrárias devido a restrições de CORS. O buscador usa um user-agent genérico e não se autentica.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas