Detector de nomes de arquivos duplicados

Uma exportação de pasta mostra report.pdf, report (1).pdf e report (2).pdf, e você quer confirmar o que foi duplicado antes de limpar. Cole uma lista de nomes de arquivos, um por linha, e esta ferramenta conta quantas vezes cada nome aparece. Os caminhos são ignorados: apenas o nome do arquivo no final de cada linha é comparado, e você escolhe se maiúsculas e minúsculas contam.

Como encontrar nomes de arquivos duplicados

  1. 1

    Cole a lista

    Um nome de arquivo por linha. Se a linha contiver um caminho completo, apenas o nome do arquivo no final é comparado.

  2. 2

    Escolha a opção de correspondência

    Deixe "Ignorar maiúsculas e minúsculas" ativado para que `IMG_1234.jpg` e `img_1234.JPG` contem como um só nome, ou desative para correspondência exata.

  3. 3

    Detecte duplicados

    Clique no botão. Cada nome que aparecer mais de uma vez é agrupado com sua contagem.

  4. 4

    Use o resultado

    A saída é uma lista CSV curta: nome, contagem. Copie-a para seu script de limpeza ou planilha.

Como funciona a correspondência

Configuração Comportamento Exemplo
Ignorar maiúsculas e minúsculas (padrão) Maiúsculas e minúsculas não importam IMG_1234.jpg = img_1234.JPG
Exato Os nomes precisam ser idênticos IMG_1234.jpg só corresponde a IMG_1234.jpg
Caminhos completos Apenas o nome do arquivo no final é comparado /photos/IMG_1234.jpg = IMG_1234.jpg

A saída lista cada nome repetido uma vez com sua contagem. Nomes que aparecem apenas uma vez não são listados.

Padrões que esta ferramenta detecta

  • Cópias de downloads do navegador. doc.pdf, doc (1).pdf e doc (2).pdf aparecem quando você salva o mesmo arquivo repetidamente.
  • Marcadores de “cópia” do macOS. file.jpg e file copy.jpg, file copy 2.jpg.
  • Sufixos de duplicados do Windows. name - Copy.docx, name - Copy (2).docx.
  • Importações de pastas de câmera. O mesmo nome IMG_1234 cai em várias pastas de anos quando o contador da câmera é reiniciado.

O que a ferramenta não faz

  • Não compara conteúdo. Dois arquivos diferentes chamados invoice.pdf contam como duplicados aqui. A ferramenta compara apenas nomes, então verifique o conteúdo antes de excluir.
  • Não faz correspondências aproximadas. report.pdf e reprot.pdf são nomes diferentes e não são agrupados.
  • Não trata extensões separadamente. photo.jpg e photo.png são nomes diferentes.
  • Não exclui nada. A ferramenta apenas lista nomes e contagens; a decisão é sua.

Depois de encontrar duplicados

  1. Não exclua automaticamente. Revise os grupos, principalmente quando os nomes são comuns (report.pdf, image.jpg).
  2. Verifique o conteúdo antes de excluir: compare os tamanhos dos arquivos ou um hash do conteúdo (SHA-256) para confirmar que os arquivos são realmente iguais.
  3. Faça um backup primeiro quando os arquivos vierem de um arquivo que você não pode substituir.

Perguntas frequentes

Apenas os nomes. Para detecção de duplicados por conteúdo, você precisa de uma ferramenta de hash que leia os bytes reais do arquivo. Este detector trabalha com listas simples de nomes, como as de exportações de diretórios.

Sim. Quando uma linha contém um caminho, apenas o nome do arquivo no final é comparado; as partes da pasta são ignoradas.

Porque “Ignorar maiúsculas e minúsculas” está ativado por padrão. Desative-o e a ferramenta tratará os dois nomes como diferentes.

Sim. A lista é enviada ao nosso servidor para que a detecção seja executada, e o resultado aparece na página. A lista não é armazenada depois.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas