Programadores
Codificador de entidades HTML
<, &, " — os carateres especiais do HTML codificados e descodificados sem erros.
Mostrar um excerto de código numa página, inserir um texto que contém «<» ou «&» sem partir a marcação, ou decifrar um conteúdo cheio de &eacute; recuperado de um feed antigo: as entidades HTML são uma passagem obrigatória do trabalho web. Esta ferramenta converte nos dois sentidos, em direto: os carateres especiais tornam-se entidades seguras na codificação, e tanto as entidades nomeadas como as numéricas (&amp;, &#38;, &#x26;) voltam a ser carateres legíveis na descodificação. Cole, converta, copie — tudo no seu navegador, sem que nenhum conteúdo seja transmitido a um servidor. Grátis, sem registo, sem limites de utilização, e aguenta grandes blocos de marcação sem esforço.
Como funciona?
- Cole o texto ou o código HTML na área de entrada.
- Clique em «Codificar» para proteger os carateres especiais, ou «Descodificar» para os restituir.
- O resultado aparece instantaneamente.
- Copie-o num clique.
Perguntas frequentes
Porque é preciso codificar <, > e & em HTML?
Porque são os carateres estruturantes da linguagem: um «<» não codificado abre uma etiqueta, um «&» inicia uma entidade. Deixados por escapar dentro de um conteúdo, partem a apresentação na melhor das hipóteses — e abrem a porta a injeções XSS na pior, quando o conteúdo vem de utilizadores. Codificá-los neutraliza a interpretação.
Porque é que &amp; aparece literalmente na minha página?
É uma dupla codificação: um texto já codificado foi codificado uma segunda vez, muitas vezes por um CMS ou um modelo que escapa automaticamente. O «&» de «&amp;» tornou-se «&amp;amp;». Descodifique aqui uma vez para recuperar o texto limpo e garanta depois que só resta uma camada de escape na sua cadeia de publicação.
Entidades nomeadas ou numéricas: quais preferir?
Ambas são válidas: &eacute; e &#233; produzem o mesmo «é». As entidades nomeadas são mais legíveis, mas a lista é finita; as numéricas cobrem todo o Unicode. Na prática, em páginas UTF-8, só &lt;, &gt;, &amp; e &quot; continuam a ser realmente necessárias.
Ainda preciso de codificar os carateres acentuados (é, ü, ñ)?
Não — já não, desde que as páginas passaram a ser servidas em UTF-8: o «é» pode figurar tal e qual no HTML. As entidades como &eacute; datam da época das codificações pouco fiáveis. Reserve a codificação para os carateres estruturantes — e descodifique os conteúdos antigos cheios de entidades para recuperar um texto limpo e legível.