Decodificador HTML
Convierte entidades y secuencias escapadas en caracteres legibles.
Si extraes datos de la web o consultas una base de datos antigua, a menudo encuentras códigos extraños como & en vez de &, < en vez de < o " en vez de comillas. Esta transformación protege los documentos frente a fallos de sintaxis, pero vuelve el texto ilegible para las personas. Con esta herramienta puedes revertir el proceso al instante y recuperar la redacción limpia original.
Por qué los navegadores transforman caracteres en entidades
Los navegadores interpretan símbolos como < y > como delimitadores de etiquetas. Si quieres mostrar código en pantalla con <script> sin que se ejecute ni altere la maqueta, el estándar exige escapar dichos caracteres. El ampersand (&) sirve de prefijo para todas las entidades, por lo que debe transformarse en & para evitar conflictos sintácticos.
Aunque esta protección resulta indispensable en una página web, entorpece el trabajo cuando exportas información a hojas de cálculo, procesadores de texto o correos. Decodificar consiste en revertir estas secuencias a sus caracteres originales para devolverles su legibilidad natural.
Entidades frecuentes en respuestas y bases de datos
&→ &<→ <>→ >"→ " (comilla doble)'→ ' (apóstrofo) → espacio indivisible©→ © (derechos de autor)—→ — (raya tipográfica)
Dos formatos de codificación en el código fuente
- Entidades con nombre — Emplean alias reconocibles como
©. Son cómodas de leer al programar, aunque su repertorio estándar es acotado. Cada navegador reconoce entre 150 y 300 de estas designaciones. - Entidades numéricas — Representan caracteres mediante su posición Unicode en base decimal como
©o en notación hexadecimal como©. Abarcan cualquier símbolo del estándar universal.
Cuándo conviene decodificar tus textos
El caso más habitual surge al consumir canales RSS, volcados SQL o respuestas JSON de servicios externos. Muchas plataformas sanean cadenas al guardar formularios y almacenan el contenido codificado. Si necesitas generar informes o procesar ese material, las secuencias afean la presentación y alteran el recuento de caracteres.
También resulta útil ante el doble escape, que sucede cuando un script procesa texto ya codificado y convierte de nuevo el ampersand en &. Con el decodificador restauras el texto original al instante, eliminando errores de lectura en tu flujo de trabajo.
Preguntas frecuentes sobre la decodificación de texto
¿En qué se diferencia esta decodificación del escape de direcciones web?
La codificación de URLs sustituye espacios y signos reservados por signos de porcentaje y valores hexadecimales. En cambio, las entidades de marcado emplean un ampersand inicial y un punto y coma final para evitar conflictos en la sintaxis de las páginas.
¿Supone un riesgo de seguridad usar texto decodificado en una web?
Sí, si los datos provienen de fuentes no seguras. Al decodificar secuencias como <script>, las etiquetas vuelven a ser operativas en el navegador. Si insertas ese texto sin filtrar en una página pública, puedes abrir una brecha ante ataques de inyección de código.
¿Por qué existen entidades en formato hexadecimal?
La notación hexadecimal permite representar cualquier carácter del estándar universal sin requerir un nombre reservado. Es muy común para símbolos especiales, iconos y caracteres de alfabetos internacionales que carecen de alias propio.
¿Mis datos permanecen privados al usar esta herramienta?
Sí. Toda la conversión se procesa de manera local en tu navegador mediante código del lado del cliente. Ninguna cadena ni información confidencial sale de tu ordenador ni se guarda en servidores remotos.
¿Qué ocurre con las entidades de espacio indivisible como ?
La entidad se transforma en un espacio duro literal. Aunque visualmente parece un espacio corriente, conserva su propiedad estructural e impide que el navegador divida dos palabras vinculadas al cambiar de línea.