Conversor de PDF para Excel

PDF para Excel

O PDF, as tabelas extraídas e os downloads ficam neste navegador.

Restaurando a sessão privada do navegador...

Escolha um PDF

PDF com texto, até 20 MiB e 150 páginas. Digitalizações precisam de OCR primeiro.

Detectando tabelas no PDF...

Nenhuma tabela regular com texto foi encontrada. Digitalizações precisam de OCR e layouts irregulares podem exigir ajustes manuais.

Transforme tabelas regulares de um PDF com texto em arquivos de planilha sem enviar o documento. O conversor usa a posição do texto selecionável no PDF para encontrar tabelas retangulares, mantém separadas as tabelas prováveis e permite revisá-las e selecioná-las antes da exportação. Baixe uma pasta de trabalho XLSX com uma planilha para cada tabela selecionada ou salve cada tabela como CSV ou TSV. Digitalizações precisam passar por OCR primeiro, e layouts irregulares ainda podem exigir ajustes manuais.

Como converter uma tabela de PDF para Excel

  1. 1

    Escolha um PDF com texto

    Selecione um PDF verdadeiro com até 20 MiB e 150 páginas. O texto precisa ser selecionável; uma digitalização composta apenas de imagens requer OCR primeiro.

  2. 2

    Revise as tabelas detectadas

    O detector local procura pelo menos duas linhas com posições de coluna estáveis. Selecione apenas as tabelas cuja prévia corresponda ao documento original.

  3. 3

    Escolha as opções de CSV

    Para CSV ou TSV, escolha vírgula, ponto e vírgula ou tabulação, decida se deseja incluir um BOM UTF-8 e mantenha a proteção contra fórmulas ativada, a menos que confie na origem.

  4. 4

    Baixe localmente

    Baixe uma pasta de trabalho XLSX com as tabelas selecionadas ou baixe cada tabela selecionada em seu próprio arquivo CSV ou TSV.

O que o detector consegue recuperar e quais são os limites

As páginas de um PDF armazenam texto posicionado, não células de planilha. Este conversor agrupa textos próximos em linhas, procura posições de coluna repetidas, preenche células ausentes e rejeita blocos que não se parecem com uma tabela regular. Ele também considera a rotação e a área visível da página ao interpretar as posições.

Conteúdo do PDF Resultado provável O que conferir
Tabela simples com duas ou mais colunas alinhadas Geralmente detectada como uma tabela retangular Compare cabeçalhos, ordem das linhas e células vazias com o PDF
Várias tabelas separadas em uma ou mais páginas Mantidas como tabelas separadas e selecionáveis Escolha somente as tabelas que deseja incluir na pasta de trabalho
Tabela da direita para a esquerda com colunas regulares Preservada na ordem visual da direita para a esquerda Confira números e células com sistemas de escrita diferentes na prévia
Parágrafos, títulos, cabeçalhos e rodapés Geralmente excluídos porque não formam uma tabela Verifique se nenhum bloco que não pertence à tabela foi incluído
Células mescladas, tabelas aninhadas ou registros com várias linhas Podem ser divididos, deslocados ou rejeitados Corrija a planilha manualmente ou use um extrator especializado
Digitalização apenas em imagem, manuscrito ou recibo fotografado Não há texto selecionável de tabela para detectar Aplique OCR primeiro e tente novamente com o PDF pesquisável

O detector é propositalmente conservador. É melhor não apresentar nenhuma tabela do que transformar textos sem relação em uma planilha convincente, porém incorreta. Sempre compare valores importantes com o PDF original antes de fazer cálculos, importações ou conciliações.

Formatos de exportação

XLSX cria uma planilha para cada tabela selecionada, com no máximo 200 planilhas em um download. Cada valor extraído é gravado como uma célula de texto. O conversor não tenta interpretar números, datas, fórmulas, moedas ou formatos contábeis, e não recria bordas, fontes, células mescladas nem o design original da página.

CSV e TSV baixam cada tabela selecionada separadamente. Estão disponíveis os delimitadores vírgula, ponto e vírgula e tabulação. Campos que contêm delimitador, aspas ou quebra de linha são colocados entre aspas duplas, e os registros usam finais de linha CRLF de acordo com as regras comuns descritas na RFC 4180. Um BOM UTF-8 vem ativado por padrão para melhorar a compatibilidade com programas de planilha, mas o delimitador correto ainda depende do aplicativo e das configurações regionais usados na importação.

Segurança contra fórmulas de planilha

Um PDF pode conter texto que começa com =, +, - ou @. Alguns programas de planilha podem interpretar esse texto como uma fórmula quando um arquivo CSV é aberto. A proteção contra fórmulas vem ativada por padrão e adiciona um prefixo às células CSV que parecem fórmulas, aumentando a chance de continuarem como texto. A proteção também inclui células com espaços iniciais e as variantes de largura completa desses caracteres.

Essa medida reduz o risco, mas não é uma garantia universal de segurança. A orientação da OWASP sobre injeção em CSV observa que o comportamento varia entre programas e que o escape pode mudar depois que um CSV é salvo e aberto novamente. Mantenha a proteção ativada para PDFs não confiáveis, confira as células exportadas e não ative macros nem ignore avisos de segurança da planilha. A saída XLSX grava os valores extraídos como células de texto explícitas, não como fórmulas.

Limites e armazenamento privado no navegador

  • Um PDF por vez, com até 20 MiB e 150 páginas.
  • PDFs com excesso de fragmentos de texto, volume de texto ou dados tabulares são rejeitados antes que possam sobrecarregar o navegador.
  • A prévia mostra as primeiras 100 linhas de cada tabela detectada; a exportação inclui todas as linhas detectadas dentro dos limites de segurança.
  • Uma pasta de trabalho pode conter até 200 planilhas selecionadas.
  • PDFs protegidos por senha e criptografados não são aceitos. Desbloqueie uma cópia que você tenha permissão para usar antes da conversão.
  • Durante o fluxo de três etapas, o PDF original, as tabelas detectadas e as configurações ficam armazenados de forma privada neste navegador por 30 minutos. São mantidos no máximo três trabalhos e 80 MiB de dados locais.
  • Apenas um identificador aleatório do trabalho aparece na URL do fluxo. O PDF, os valores extraídos e os arquivos baixados não são enviados pelo nossos servidores nem carregados no servidor de resultados.
  • A opção Recomeçar remove o trabalho local atual. Registros expirados ou inválidos são apagados na próxima vez que a ferramenta verificar o armazenamento do navegador.

O PDF é carregado a partir de seus bytes locais por meio do PDF.js. A ferramenta baixa suas bibliotecas como recursos normais da Web, mas não envia o PDF selecionado com essas solicitações.

Revisão acessível

O controle de envio funciona com o teclado, o progresso e os erros são anunciados às tecnologias assistivas, e as tabelas detectadas usam legendas e cabeçalhos de coluna. A prévia permite rolagem horizontal em telas pequenas e preserva a direção detectada para tabelas da direita para a esquerda. Esses recursos ajudam a revisar a extração, mas não substituem a comparação com o documento original quando a precisão é importante.

Perguntas frequentes

O detector exige texto selecionável organizado em pelo menos duas linhas com posições de coluna estáveis. Uma digitalização, um layout de uma única linha, um formulário feito com elementos gráficos ou uma tabela irregular pode não atender a esse critério. Aplique OCR a páginas que só contenham imagens ou use uma ferramenta especializada para layouts complexos.

Não. Ele lê o texto que já está incorporado no PDF. Se você não consegue selecionar ou copiar o texto da tabela em um leitor de PDF, primeiro crie um PDF pesquisável com OCR e depois tente usar essa cópia.

Escolha XLSX quando quiser todas as tabelas selecionadas em uma pasta de trabalho, com uma planilha por tabela. Escolha CSV para um arquivo de texto de importação com ampla compatibilidade. Escolha TSV, separado por tabulações, quando vírgulas ou pontos e vírgulas forem comuns nos dados ou quando o destino exigir tabulações.

O conversor preserva os caracteres extraídos em vez de tentar adivinhar o significado. Um valor como 1,234.56 ou 01/02/2026 pode ter significados diferentes em regiões distintas. Converta a coluna de forma intencional na sua planilha depois de conferir as convenções de número decimal e data.

Quando ativada, ela adiciona um prefixo às células CSV que começam como fórmulas, inclusive =, +, -, @ e as variantes de largura completa após possíveis espaços iniciais. Isso reduz a execução acidental de fórmulas, mas não pode garantir um comportamento seguro em todos os programas nem depois de cada novo salvamento. Mantenha a proteção ativada para dados não confiáveis e revise o resultado.

Não. O PDF original, as tabelas detectadas e os arquivos XLSX, CSV ou TSV permanecem no seu navegador. Um trabalho do fluxo fica armazenado no navegador por 30 minutos, e apenas seu identificador aleatório aparece na URL. Recomeçar remove o trabalho local atual.

Sim. A ferramenta pode detectar tabelas regulares separadas ao longo de um PDF. Selecione as que você precisa e baixe uma pasta de trabalho XLSX com até 200 planilhas, ou baixe cada tabela selecionada separadamente como CSV ou TSV.

Nem sempre. A rotação da página é considerada, mas rótulos verticais, tabelas aninhadas, células mescladas, registros com várias linhas e layouts decorativos ainda podem ser deslocados ou rejeitados. Use a prévia, compare os totais com o PDF e corrija a planilha antes de confiar nela.

Ferramentas relacionadas