Conversor de secuencias de escape Unicode

Elige cómo representar el texto: escapes Unicode \uXXXX, referencias HTML decimales o hexadecimales. Para recuperar texto, el decodificador reconoce las tres formas incluso si están mezcladas. No convierte bytes UTF-8 ni interpreta un programa JavaScript completo.

Se ejecuta localmente en tu navegador

Seleccionar el formato de salida

Pega el contenido en la entrada. La conversión se realiza en el navegador sin enviar el texto en solicitudes de red; no hay carga de archivos ni procesamiento por lotes.

  1. Selecciona escapes Unicode, referencias decimales o referencias hexadecimales y pulsa Codificar texto.
  2. Si la entrada contiene secuencias que quieres leer, pulsa Decodificar secuencias. Esta acción combina los tres formatos admitidos y no depende de la selección.
  3. Copia el resultado. Editar la entrada, cambiar el formato o encontrar un error borra la salida anterior y desactiva la copia. Limpiar vacía ambos campos, pero conserva el formato; para otra operación, pega tú el resultado en la entrada.

Qué significa cada representación

Cuatro dígitos por unidad UTF-16

El modo Unicode genera \u seguido de exactamente cuatro dígitos hexadecimales en minúsculas por unidad de código, sin comillas exteriores. A se escribe \u0041, Ā se escribe \u0100 y un salto LF real se escribe \u000a. El emoji 😀 necesita el par \ud83d\ude00.

Las referencias numéricas usan puntos de código completos: A你😀 da A你😀 en decimal y A你😀 en hexadecimal. Estas últimas usan dígitos hexadecimales en mayúsculas, sin longitud fija. También se codifican letras y espacios.

Leer secuencias dentro del texto

Se reconoce \u con u minúscula y cuatro dígitos hexadecimales, además de referencias decimales o hexadecimales terminadas en punto y coma. El prefijo hexadecimal puede ser &#x o &#X; sus dígitos admiten mayúsculas y minúsculas. Así, \u0041你😀 da A你😀.

Solo se hace una pasada: \u005cu0041 produce el texto literal \u0041 y A produce A, no A. Las secuencias recién formadas no se vuelven a procesar. No se analiza un documento JSON completo ni se ejecuta código; el resultado se muestra como texto, no como HTML.

La validación depende del formato

Las reglas HTML estrictas de he 1.2.0 solo se aplican a la codificación numérica y a la decodificación de referencias numéricas. Codificar escapes Unicode o decodificar \u permite NUL, U+0080 y U+FFFF; la codificación numérica los rechaza. Ningún modo codifica sustitutos aislados, y el resultado decodificado tampoco puede contenerlos.

El par \uD83D\uDE00 recupera 😀, pero �� se rechaza: las referencias numéricas no combinan valores sustitutos. También se rechazan �, € y �.

Dudas sobre los escapes Unicode

¿Por qué una secuencia aparentemente incorrecta no da error?

Lo no reconocido se conserva: \uZZZZ, \u{41}, \U0041, \n, &, &#xZZ; o &#65 sin punto y coma. Los números sueltos, como 65 66, tampoco se interpretan. En cambio, una referencia numérica reconocida puede fallar la validación estricta.

¿La conversión conserva espacios y saltos de línea?

No se recortan espacios ni se normaliza Unicode. La entrada vacía da una salida vacía. El área de texto convierte los saltos CRLF y CR reales en LF. El núcleo puede codificar CR como 
, pero la decodificación numérica estricta rechaza 
 no se garantiza una ida y vuelta exacta para cualquier entrada.

Herramientas recientes: