Décodeur HTML
Convertissez les entités HTML en caractères lisibles.
Vous recevez un texte rempli de codes énigmatiques : & au lieu de &, < au lieu de <, " au lieu de guillemet. C’est du HTML encodé, une protection qui transforme les caractères spéciaux en séquences inoffensives. Décodé, c’est lisible.
Comment et pourquoi le HTML s’encode
L’encodage HTML (aussi appelé HTML escaping) transforme les caractères dangereux en symboles inoffensifs. Pourquoi ? Parce que < et > sont réservés au HTML lui-même pour marquer les balises. Si vous voulez afficher littéralement le texte , sans que le navigateur le traite comme une balise, vous devez l’encoder en <script>. De même, & devient & pour éviter les collisions. C’est une question de sécurité et de clarté.
Les guillemets, les apostrophes, les accents graves (`) : chacun a son code d’entité. Un texte bien encodé peut transiter sans perte à travers des systèmes qui pourraient autrement le mal interpréter.
Les entités HTML que vous croiserez le plus
&→ &<→ <>→ >"→ " (guillemet droit)'→ ’ (apostrophe) → espace insécable©→ © (copyright)—→ — (tiret cadratin)
Deux formats d’entités
- Entités nommées — Utilisant un nom lisible comme
©. Elles sont faciles à mémoriser pour les caractères courants, mais limitées en nombre. Chaque navigateur en reconnaît environ 150 à 300. - Entités numériques — Utilisant un numéro unicode comme
©(pour ©) ou en hexadécimal©. Elles peuvent coder n’importe quel caractère unicode, mais elles sont moins lisibles.
Les cas où le décodage devient indispensable
Un scraper web récupère du HTML et le stocke en base de données, déjà encodé. Vous le relisez plus tard et vous avez besoin de le décoder pour l’afficher correctement. Un formulaire accepte du texte utilisateur, le système le stocke encodé par prudence, mais votre CMS doit le montrer à l’administrateur en clair. Un flux RSS ou une API JSON peut livrer du contenu en entités HTML. Une migration de système ancien vers nouveau peut dupliquer l’encodage. Chaque fois, le décodeur vous épargne du travail manuel et des erreurs de parsing.
Questions sur le décodage HTML
Le double encodage, c’est quoi ?
Quand un texte déjà encodé est encodé une deuxième fois. Par exemple & devient &. Le décodeur le ramène à la forme lisible en une ou plusieurs passes.
Est-ce que décoder endommage mon texte ?
Non. Le décodeur restitue exactement le texte original. Le processus est réversible.
Faut-il décoder avant de publier ?
Cela dépend du contexte. Si le texte doit s’afficher en HTML, il doit rester encodé. Si c’est pour le lire ou le traiter, le décoder le rend humainement lisible.
Puis-je décoder plusieurs fois le même texte ?
Une seule fois est suffisant. Décoder un texte déjà décodé ne change rien à la sortie.
Et les accents accentués en français ?
Les accents comme é, è, ê peuvent être encodés en entités HTML (é, è, ê) ou rester en UTF-8 direct. Le décodeur gère les deux.