1001Ferramentas
📝 Texto

Remover Tags HTML

Remove tags HTML (<p>, <a>, <div>...) preservando o texto interno. Útil para extrair apenas o conteúdo legível de uma página.

Tirar as tags e ficar com o texto

Você copiou um trecho de um CMS, de um e-mail em HTML ou de um export de banco e veio tudo embrulhado em tag de parágrafo, span com estilo inline e div atrás de div. O que interessa é o texto do meio. Cole o bloco no campo e a versão sem marcação aparece enquanto você digita, sem abrir editor de código nem escrever um script só para isso.

A regra é literal: tudo que estiver entre o sinal de menor e o próximo sinal de maior é apagado, e nada entra no lugar. Daí vêm dois comportamentos que surpreendem. Parágrafos vizinhos ficam grudados, porque a tag some sem virar espaço, e duas células de tabela com Ana e Silva saem como AnaSilva. E o conteúdo de script e de style permanece, já que só a tag foi removida, não o código que estava dentro dela.

Cuidado com texto que usa os símbolos de menor e maior soltos, como numa comparação matemática: o trecho entre eles é lido como tag e desaparece. Entidades também não são decodificadas, então os códigos do e comercial e do espaço fixo continuam escritos do mesmo jeito. E não trate isso como sanitizador: apagar tag não neutraliza HTML malicioso de terceiro, para isso existe biblioteca própria. Roda inteiro no navegador.

Perguntas frequentes

Por que os parágrafos ficam grudados no resultado?
Porque a tag é apagada sem ser substituída por espaço ou quebra de linha. Se o texto vier de tabela ou de lista, separe as partes na mão depois.
Ele apaga o código dentro de script e style?
Não. Só as tags saem, então o JavaScript e o CSS ficam soltos no meio do texto. Remova esses blocos antes de colar.
Posso usar para limpar HTML enviado por usuários antes de exibir no site?
Não. É ferramenta de leitura, não de segurança. Para exibir conteúdo de terceiros, use uma biblioteca de sanitização que entenda o DOM.

Ferramentas Relacionadas