Outils pour Développeurs

Décodage HTML

Retransformez les entités HTML en caractères normaux.

Évaluez cet outil

Comment utiliser Décodage HTML

  1. Collez un texte contenant des entités HTML.
  2. Copiez les caractères décodés.

À propos de Décodage HTML

Le décodage retransforme les entités en caractères qu'elles représentent : & en esperluette, < en signe inférieur, ' en apostrophe. C'est ce dont vous avez besoin lorsqu'un contenu arrive échappé — voire doublement échappé — depuis une base de données, un flux, une API ou une page extraite par scraping, et que vous voulez retrouver le texte d'origine.

Plutôt qu'une table de correspondance écrite à la main, cet outil confie la tâche à l'analyseur HTML natif de votre navigateur, qui connaît l'ensemble complet des entités nommées —  , ©, é et des centaines d'autres — ainsi que les références numériques décimales comme — et hexadécimales comme —. Les formes nommées et numériques sont interchangeables ; la forme numérique se contente de nommer directement le point de code Unicode. Un texte sans entités passe inchangé.

Un vrai balisage ressort en texte brut : décodez une balise <b> échappée et vous récupérez les caractères littéraux, pas du texte en gras. Rien n'est ici rendu ni exécuté, et rien n'est envoyé où que ce soit — tout se passe localement dans la page. Il faut garder à l'esprit que le résultat décodé est de nouveau du texte brut : s'il doit repartir vers une page web, il doit être rééchappé, dans le bon contexte, avec l'encodeur HTML.

Questions fréquentes

Quelles entités sont prises en charge ?

Pratiquement toutes. Le décodage utilise l'analyseur HTML intégré de votre navigateur plutôt qu'une liste fixe, si bien que l'ensemble complet des entités nommées fonctionne aux côtés des références décimales comme &#8212; et hexadécimales comme &#x2014;.

Va-t-il rendre ou exécuter le HTML que je colle ?

Non. Le résultat est du texte brut — une balise échappée se décode en caractères littéraux de cette balise, pas en élément rendu. Rien dans votre saisie n'est exécuté.

Mon texte affiche encore une entité après le décodage. Pourquoi ?

Il était doublement encodé : la séquence &amp;lt; se décode en &lt;, qui se décode à nouveau en signe inférieur. Relancez le décodage une seconde fois pour retrouver l'original, puis cherchez pourquoi la valeur est passée par deux étapes d'échappement en amont.

&nbsp; est-il un simple espace normal ?

Pas tout à fait. Il se décode en espace insécable, U+00A0 — un caractère différent de l'espace ordinaire, même s'il paraît identique. Cette différence perturbe étonnamment souvent les comparaisons de chaînes et les correspondances par expressions régulières.

Mon contenu est-il envoyé à un serveur ?

Non. Le décodage a lieu dans votre navigateur, si bien que le contenu collé reste sur votre machine.