Converter o conteúdo do campo

O campo aceita texto e referências decimais, inclusive misturados. A conversão acontece no navegador, sem enviar o conteúdo em requisições de conversão. O resultado é exibido e copiado como texto simples.

  1. Codifique A你😀 para obter A你😀. A operação também converte letras ASCII, espaços e pontuação.
  2. Para decodificar, use &# seguido de algarismos decimais e ponto e vírgula. Em oi A, apenas a referência é substituída: a saída será oi A.
  3. Copie a saída. Para aplicar outra conversão, cole-a no campo de entrada. Alterar a entrada ou encontrar um erro remove o resultado anterior; Limpar esvazia os dois conteúdos.

Como as referências são interpretadas

O número representa o caractere, não um byte

😀 vira 😀, usando seu ponto de código completo. As duas referências de substitutos ��, produzidas pela versão antiga, não são referências HTML válidas aqui e são rejeitadas.

Esta página decodifica somente referências decimais com ponto e vírgula. Não interpreta A, &, \u0041, listas de números ou &#65 sem o terminador. As ferramentas ASCII e Unicode têm formatos adicionais; não há conversão de bytes UTF-8 neste campo.

Uma substituição sem apagar o restante

O texto ao redor das referências permanece na saída. A leitura ocorre uma única vez: A resulta em A literal, não em A. Isso não equivale a analisar ou validar um documento HTML inteiro.

As referências reconhecidas passam pela validação estrita de he 1.2.0. �, € e � são exemplos rejeitados, assim como valores de substitutos. A codificação também rejeita caracteres HTML não permitidos e substitutos sem par. Em caso de erro, a saída anterior é limpa e a cópia fica desativada.

Perguntas sobre a conversão decimal

A formatação volta exatamente como era?

Os espaços não são aparados e não há normalização Unicode. Espaço vira   e LF vira 
. O campo, porém, normaliza quebras CR e CRLF reais para LF. Embora o núcleo consiga codificar CR como 
, a decodificação estrita rejeita 
. Portanto, nem toda entrada tem uma ida e volta exata.

Uma entrada sem referências deveria dar erro?

Em geral, não: sem referências decimais reconhecidas, o texto permanece igual, e uma entrada vazia gera uma saída vazia. Porém, caracteres substitutos reais sem par no resultado são rejeitados. O texto literal \uD800 não é esse caractere e permanece igual. Referências reconhecidas também podem falhar na validação. Apesar do nome antigo Native / Unicode, a página não decodifica escapes Unicode em geral.

Ferramentas recentes: