Elige cómo representar el texto: escapes Unicode \uXXXX, referencias HTML decimales o hexadecimales. Para recuperar texto, el decodificador reconoce las tres formas incluso si están mezcladas. No convierte bytes UTF-8 ni interpreta un programa JavaScript completo.
Se ejecuta localmente en tu navegadorPega el contenido en la entrada. La conversión se realiza en el navegador sin enviar el texto en solicitudes de red; no hay carga de archivos ni procesamiento por lotes.
El modo Unicode genera \u seguido de exactamente cuatro dígitos hexadecimales en minúsculas por unidad de código, sin comillas exteriores. A se escribe \u0041, Ā se escribe \u0100 y un salto LF real se escribe \u000a. El emoji 😀 necesita el par \ud83d\ude00.
Las referencias numéricas usan puntos de código completos: A你😀 da A你😀 en decimal y A你😀 en hexadecimal. Estas últimas usan dígitos hexadecimales en mayúsculas, sin longitud fija. También se codifican letras y espacios.
Se reconoce \u con u minúscula y cuatro dígitos hexadecimales, además de referencias decimales o hexadecimales terminadas en punto y coma. El prefijo hexadecimal puede ser &#x o &#X; sus dígitos admiten mayúsculas y minúsculas. Así, \u0041你😀 da A你😀.
Solo se hace una pasada: \u005cu0041 produce el texto literal \u0041 y A produce A, no A. Las secuencias recién formadas no se vuelven a procesar. No se analiza un documento JSON completo ni se ejecuta código; el resultado se muestra como texto, no como HTML.
Las reglas HTML estrictas de he 1.2.0 solo se aplican a la codificación numérica y a la decodificación de referencias numéricas. Codificar escapes Unicode o decodificar \u permite NUL, U+0080 y U+FFFF; la codificación numérica los rechaza. Ningún modo codifica sustitutos aislados, y el resultado decodificado tampoco puede contenerlos.
El par \uD83D\uDE00 recupera 😀, pero �� se rechaza: las referencias numéricas no combinan valores sustitutos. También se rechazan �, € y �.
Lo no reconocido se conserva: \uZZZZ, \u{41}, \U0041, \n, &, &#xZZ; o A sin punto y coma. Los números sueltos, como 65 66, tampoco se interpretan. En cambio, una referencia numérica reconocida puede fallar la validación estricta.
No se recortan espacios ni se normaliza Unicode. La entrada vacía da una salida vacía. El área de texto convierte los saltos CRLF y CR reales en LF. El núcleo puede codificar CR como , pero la decodificación numérica estricta rechaza no se garantiza una ida y vuelta exacta para cualquier entrada.