Wandeln Sie Text in dezimale HTML-Zeichenreferenzen um oder lesen Sie numerische Referenzen und unterstützte \uXXXX-Sequenzen innerhalb eines Textes. Es geht um Unicode-Zeichenreferenzen, nicht um ASCII-Bytes oder reine Zahlenlisten.
Läuft lokal in deinem BrowserFügen Sie den Inhalt direkt ein. Die Umwandlung läuft im Browser, ohne die Eingabe per Netzwerkanfrage zu senden. Dateiimport und Stapelverarbeitung sind nicht vorgesehen.
A你😀 ergibt A你😀. Das Emoji wird als ganzer Codepunkt dargestellt, nicht als zwei Surrogatreferenzen. Auch Buchstaben und Leerzeichen werden kodiert: é als é, ein Leerzeichen als   und LF als . Die Ausgabe verwendet keine benannten Referenzen.
Erkannt werden dezimale Referenzen wie A, hexadezimale wie A oder A sowie \u mit kleinem u und vier folgenden Hexadezimalziffern, etwa \u0041. Numerische Referenzen benötigen ein Semikolon. Bei Hexadezimalziffern sind Groß- und Kleinschreibung erlaubt; umgebender Klartext bleibt erhalten.
😀, 😀 und das Paar \uD83D\uDE00 ergeben jeweils 😀. Es werden einzelne Sequenzen umgewandelt, keine vollständigen JS/JSON-Zeichenfolgen geparst und kein HTML ausgeführt.
he 1.2.0 prüft beim Kodieren und beim Dekodieren numerischer Referenzen die strikten HTML-Regeln. Referenzen wie �, €, � und � werden abgelehnt. Beim Kodieren gilt das auch für NUL, C1-Steuerzeichen wie U+0080, U+FFFF und ungepaarte Surrogate.
Für den \uXXXX-Zweig gelten diese HTML-Prüfungen nicht: \u0000 und \uFFFF werden zu ihren Codeeinheiten dekodiert. Die abschließende Ausgabeprüfung weist nur ungepaarte Surrogate zurück.
Die alte Schreibweise �� wird abgelehnt, nicht zusammengesetzt. Verwenden Sie für dieses Emoji 😀.
Nur die drei erkannten Formen werden verarbeitet. \uZZZZ, \u{41}, \U0041, &#xZZ; und A ohne Semikolon bleiben wörtlicher Text. Das gilt auch für &, Zahlen wie 65 66 und \n. Das Werkzeug validiert nicht jede denkbare Fehlschreibweise und dekodiert keine UTF-8-Bytes.
Nicht in einem Durchlauf. Sowohl A als auch \u0026#65; werden zum wörtlichen Text A, nicht zu A. Ersetzungstext wird nicht erneut durchsucht.
Leerraum wird nicht abgeschnitten und Unicode nicht normalisiert; leere Eingaben ergeben leere Ausgaben. Das Textarea-Feld vereinheitlicht tatsächliche CRLF/CR-Zeilenenden zu LF. Der Kern kann CR als kodieren, doch die strikte numerische Dekodierung lehnt ab. Nicht jede Eingabe lässt sich unverändert zurückwandeln.