Remover Tags HTML

Cole marcação HTML e esta ferramenta remove todas as tags, deixando apenas o texto que estava entre elas. Ela executa a função padrão strip_tags do PHP: tudo o que está entre colchetes angulares (<p>, <br>, <div class="...">, as tags de fechamento e os <!-- comentários -->) é removido, e o texto ao redor é mantido exatamente como estava. Você também recebe três contadores: caracteres antes, caracteres depois e quantos foram removidos.

Como funciona

  1. 1

    Cole a marcação

    Um trecho de HTML, uma página inteira copiada de Ver código-fonte, ou o corpo de um e-mail em formato HTML.

  2. 2

    Remova as tags

    Clique no botão e cada tag, tag de fechamento e comentário HTML é removido em uma única passagem no servidor.

  3. 3

    Veja os contadores

    As estatísticas mostram a contagem de caracteres antes e depois, além de quantos foram removidos.

  4. 4

    Copie o texto simples

    A saída é uma string limpa, pronta para um editor de texto, uma planilha, um prompt de IA ou processamento posterior.

O que ela faz e o que não faz

strip_tags é um removedor de tags rápido e literal. Não é um conversor completo de HTML para texto, então é útil saber exatamente onde está o limite.

  • As tags são removidas, o texto é mantido. <b>bold</b> text vira bold text. As tags de abertura, de fechamento e seus atributos desaparecem.
  • Os comentários HTML são removidos. <!-- note -->visible vira visible.
  • Nenhuma quebra de linha é inserida. Tags de bloco como <p> e <div> são simplesmente apagadas, então <p>One</p><p>Two</p> vira OneTwo. As quebras de linha que já existem no seu texto são mantidas.
  • As entidades não são decodificadas. Tom &amp; Jerry continua Tom &amp; Jerry. Para converter &amp; de volta em &, passe o resultado por um decodificador de entidades HTML.
  • O texto de script e style permanece. Só as tags <script> e <style> são removidas; o código ou o CSS entre elas permanece. Apague esses blocos você mesmo antes, se não os quiser.

Antes e depois

Entrada Resultado
<p>Hello</p> Hello
<a href="https://x.com">click</a> click
<b>bold</b> text bold text
<!-- note -->visible visible
<br><br> (vazio)
Tom &amp; Jerry Tom &amp; Jerry

Usos comuns

  • Limpar a saída de um CMS. Extraia o texto do corpo de um artigo exportado e salve como .txt simples.
  • Alimentar modelos de linguagem. Os modelos funcionam melhor com texto simples do que com marcação, então remova as tags antes de escrever o prompt.
  • Limpeza de dados extraídos. Quando um scraper devolve o innerHTML mas você só queria o texto visível.
  • Extração rápida de texto. Cole qualquer fragmento HTML e recupere as palavras sem a marcação ao redor.

Bom saber

  • Onde é executado. O processamento acontece em nosso servidor. Só as contagens de caracteres antes e depois são registradas para fins de análise, nunca o HTML em si, mas como em qualquer ferramenta online, evite colar dados realmente sensíveis.
  • Entidades e scripts. Se a saída ainda mostrar &amp; ou JavaScript restante, é o esperado: decodifique as entidades separadamente e remova os blocos <script> / <style> antes de colar.

Perguntas frequentes

Não. Ela só remove tags, então entidades como &amp;, &nbsp; e &#39; passam sem alteração. Passe o resultado por um decodificador de entidades HTML se você precisar dos caracteres reais.

Não. Tags de bloco como <p> e <div> são apagadas sem inserir uma quebra de linha, então os parágrafos podem ficar colados. As quebras de linha já presentes no seu texto são preservadas.

As próprias tags são removidas, mas o texto de JavaScript ou CSS entre elas permanece na saída. Apague esses blocos antes de colar se você não quiser o código.

Sim. Os blocos <!-- ... --> são removidos junto com as tags.

Em nosso servidor, com uma única passagem de strip_tags. A ferramenta registra apenas as contagens de caracteres antes e depois, não o conteúdo do seu HTML.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas