A agência Orqeo ↗

Programadores

Codificador de entidades HTML

<, &, " — os carateres especiais do HTML codificados e descodificados sem erros.

Resultado

Mostrar um excerto de código numa página, inserir um texto que contém «<» ou «&» sem partir a marcação, ou decifrar um conteúdo cheio de &amp;eacute; recuperado de um feed antigo: as entidades HTML são uma passagem obrigatória do trabalho web. Esta ferramenta converte nos dois sentidos, em direto: os carateres especiais tornam-se entidades seguras na codificação, e tanto as entidades nomeadas como as numéricas (&amp;amp;, &amp;#38;, &amp;#x26;) voltam a ser carateres legíveis na descodificação. Cole, converta, copie — tudo no seu navegador, sem que nenhum conteúdo seja transmitido a um servidor. Grátis, sem registo, sem limites de utilização, e aguenta grandes blocos de marcação sem esforço.

Como funciona?

  1. Cole o texto ou o código HTML na área de entrada.
  2. Clique em «Codificar» para proteger os carateres especiais, ou «Descodificar» para os restituir.
  3. O resultado aparece instantaneamente.
  4. Copie-o num clique.

Perguntas frequentes

Porque é preciso codificar <, > e & em HTML?

Porque são os carateres estruturantes da linguagem: um «<» não codificado abre uma etiqueta, um «&» inicia uma entidade. Deixados por escapar dentro de um conteúdo, partem a apresentação na melhor das hipóteses — e abrem a porta a injeções XSS na pior, quando o conteúdo vem de utilizadores. Codificá-los neutraliza a interpretação.

Porque é que &amp;amp; aparece literalmente na minha página?

É uma dupla codificação: um texto já codificado foi codificado uma segunda vez, muitas vezes por um CMS ou um modelo que escapa automaticamente. O «&amp;» de «&amp;amp;» tornou-se «&amp;amp;amp;». Descodifique aqui uma vez para recuperar o texto limpo e garanta depois que só resta uma camada de escape na sua cadeia de publicação.

Entidades nomeadas ou numéricas: quais preferir?

Ambas são válidas: &amp;eacute; e &amp;#233; produzem o mesmo «é». As entidades nomeadas são mais legíveis, mas a lista é finita; as numéricas cobrem todo o Unicode. Na prática, em páginas UTF-8, só &amp;lt;, &amp;gt;, &amp;amp; e &amp;quot; continuam a ser realmente necessárias.

Ainda preciso de codificar os carateres acentuados (é, ü, ñ)?

Não — já não, desde que as páginas passaram a ser servidas em UTF-8: o «é» pode figurar tal e qual no HTML. As entidades como &amp;eacute; datam da época das codificações pouco fiáveis. Reserve a codificação para os carateres estruturantes — e descodifique os conteúdos antigos cheios de entidades para recuperar um texto limpo e legível.

Ferramentas relacionadas