Pasar de texto a referencias y viceversa

Pega el contenido en el campo. La conversión se realiza en el navegador sin enviar la entrada mediante solicitudes de red. No hay entrada de archivos ni procesamiento por lotes.

  1. Introduce texto para codificar o texto con referencias para decodificar y ejecuta la operación correspondiente.
  2. Revisa y copia la salida, que se muestra como texto. Editar la entrada o un error de conversión borra el resultado anterior y desactiva la copia.
  3. Para otra conversión, pega tú mismo el resultado en la entrada; también puedes limpiar ambos campos.

Qué referencias se generan y cuáles se interpretan

Decimales basados en puntos de código

A你😀 se convierte en A你😀. El emoji se representa como un punto de código completo, sin dividirlo en referencias de sustitutos. También se codifican letras y espacios: é da é, el espacio   y LF 
. La salida no utiliza referencias con nombre.

Tres formas dentro del texto

Se reconocen referencias decimales como A, hexadecimales como A o A y una \u minúscula seguida de cuatro dígitos hexadecimales, como \u0041. Las referencias numéricas requieren punto y coma. Los dígitos hexadecimales admiten mayúsculas y minúsculas; el texto que rodea las referencias se conserva.

😀, 😀 y el par \uD83D\uDE00 producen 😀. No se analiza una cadena JS/JSON completa ni se ejecuta HTML.

Comprobaciones distintas según el formato

he 1.2.0 aplica comprobaciones HTML estrictas al codificar y al decodificar referencias numéricas. Rechaza referencias como �, €, � y �. La codificación rechaza NUL, controles C1 como U+0080, U+FFFF y sustitutos aislados.

Estas comprobaciones HTML no se aplican a la rama \uXXXX: \u0000 y \uFFFF se decodifican a sus unidades de código. La comprobación final de la salida solo rechaza sustitutos sin pareja.

Las antiguas referencias �� se rechazan en lugar de unirse. Usa 😀 para ese emoji.

Preguntas sobre referencias numéricas

¿Por qué algunas entradas aparentemente incorrectas no dan error?

La conversión solo reconoce las tres formas indicadas. \uZZZZ, \u{41}, \U0041, &#xZZ; y &#65 sin punto y coma quedan como texto. También &, los números sueltos como 65 66 y \n. No es un validador de cualquier sintaxis ni un decodificador de bytes UTF-8.

¿Se decodifican varias capas a la vez?

No. Tanto A como \u0026#65; dan el texto literal A, no A. El resultado de una sustitución no se vuelve a examinar.

¿Se recortan espacios o se rechaza la entrada vacía?

No se recortan espacios ni se normaliza Unicode; una entrada vacía da una salida vacía. El textarea normaliza los saltos reales CRLF/CR a LF. El núcleo puede codificar CR como 
, pero la decodificación numérica estricta rechaza esa referencia. No toda entrada admite conversión de ida y vuelta.

Herramientas recientes: