Extrair Imagens de PDF

Carregar PDF

Carregue um PDF e recupere cada imagem incorporada em sua resolução original. O extrator percorre a árvore de objetos PDF, encontra entradas /XObject /Image e exporta cada uma como PNG, sem captura de tela, sem perda de qualidade ao rasterizar a página inteira. Funciona com digitalizações, relatórios com muitas fotos, catálogos de produtos e brochuras.

Como extrair imagens de um PDF

  1. 1

    Carregue o PDF

    Solte um único arquivo; PDFs criptografados devem ser desbloqueados primeiro.

  2. 2

    Escaneie a árvore de objetos

    O extrator enumera cada imagem XObject em todas as páginas.

  3. 3

    Visualize os resultados

    Você verá cada imagem como uma miniatura com seu número de página e suas dimensões.

  4. 4

    Baixe individualmente ou como ZIP

    Pegue um único ativo ou exporte tudo em um único arquivo, nomeado `image-p1-1.png`.

Como as imagens vivem dentro de um PDF

Um PDF armazena imagens como recursos separados (/XObject streams) referenciados do conteúdo da página. O extrator lê cada stream em sua codificação nativa e reconstrói o arquivo que o autor incorporou.

Formatos que você verá

Filtro PDF O que você recebe Fonte típica
/DCTDecode PNG (de um JPEG) Fotos, imagens de produtos, digitalizações
/FlateDecode + RGB PNG Logotipos, gráficos, capturas de tela de UI
/JPXDecode PNG (de JPEG 2000) Digitalizações arquivadas de alta resolução
/CCITTFaxDecode PNG (de uma digitalização) Texto digitalizado em preto e branco
/JBIG2Decode PNG (convertido) Documentos digitalizados compactados

O extrator sempre entrega PNG: ele recodifica os pixels brutos no seu navegador, então fontes JPEG, JPEG 2000 e CCITT também chegam em PNG.

O que não será recuperado

  • Ilustrações vetoriais. Logotipos desenhados com operadores de caminho PDF não são imagens, eles vivem no stream de conteúdo, não como XObjects. Use uma ferramenta PDF-para-SVG para esses.
  • Cores de fundo e gradientes. Esses são desenhos em nível de página, não ativos incorporados.
  • Texto renderizado como contornos. Aparece como “gráficos” mas não é um objeto de imagem.

Dicas ao trabalhar com a exportação

  • Verifique as dimensões. Uma miniatura 300x300 na página pode ser na verdade uma original de 3000x3000 reduzida no momento da renderização. Você obtém os pixels de origem, não o tamanho de exibição.
  • Respeite a licença. Poder extrair uma imagem não concede direitos para reutilizá-la. Imagens de estoque em um PDF permanecem imagens de estoque quando extraídas.
  • Documentos digitalizados. Se cada página produzir uma imagem gigante com texto embutido, o PDF é uma digitalização. Execute OCR nas PNGs exportadas para recuperar o texto.

Perguntas frequentes

Páginas PDF podem aplicar uma matriz de transformação a como uma imagem é desenhada (inverter, girar, distorcer). O extrator retorna o bitmap armazenado, pixels brutos. Se um editor armazenou a imagem de cabeça para baixo e a inverteu no momento da renderização, a exportação parecerá de cabeça para baixo. Gire-a de volta em qualquer editor de imagens.

Apenas depois de desbloqueá-los. Execute o arquivo através de uma ferramenta de desbloqueio de PDF primeiro, fornecendo a senha do proprietário, e então extraia.

Sim. As imagens são adicionadas na ordem das páginas e cada nome de arquivo traz o número da página, por exemplo image-p1-2.png, para você saber de qual página veio cada imagem.

Não. O PDF de origem é aberto e lido inteiramente no seu navegador e nunca é enviado ao servidor. Apenas o ZIP com as imagens extraídas é enviado para criar o resultado protegido por sessão; ele é mantido por até 7 dias e depois excluído.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas