Text und dezimale HTML-Zeichenreferenzen

Wandle Zeichen in Dezimalreferenzen wie A um oder lies solche Referenzen innerhalb eines Textes. Beim Dekodieren bleiben normaler Text und nicht unterstützte Escape-Formate erhalten. Dieses Werkzeug ist auf die dezimale Schreibweise begrenzt.

Läuft lokal in deinem Browser

Eine Dezimaldarstellung erzeugen oder lesen

Nutze dasselbe Eingabefeld für beide Richtungen. Die Umwandlung läuft im Browser und sendet den Inhalt dafür nicht in Netzwerkanfragen. Das Ergebnis wird als reiner Text angezeigt, nicht als HTML ausgeführt.

  1. Kodiere A你😀. Die Ausgabe lautet A你😀. Auch einfache Buchstaben, Leerzeichen und Satzzeichen werden umgewandelt.
  2. Zum Dekodieren muss eine Referenz aus &#, Dezimalziffern und einem Semikolon bestehen. Aus Text A wird Text A; die Wörter neben der Referenz bleiben stehen.
  3. Kopiere das Ergebnis. Für eine weitere Umwandlung füge es selbst wieder in die Eingabe ein. Eingabeänderungen und Fehler löschen die alte Ausgabe; Leeren entfernt Ein- und Ausgabe.

Unterstützte Schreibweise und Grenzen

Codepunkte statt UTF-16-Teilwerte

Für 😀 entsteht eine einzige Referenz 😀. Die frühere Ausgabe �� enthält dagegen Surrogatwerte und wird jetzt zurückgewiesen. Das Werkzeug wandelt keine UTF-8-Bytefolgen um.

Dekodiert werden nur Dezimalreferenzen mit abschließendem Semikolon. A, &, \u0041, einzelne Zahlen und unvollständiges &#65 bleiben unverändert. Die separaten ASCII- und Unicode-Werkzeuge unterstützen zusätzliche Formate.

Nur ein Ersetzungslauf

Aus A wird der wörtliche Text A, nicht A. Eine neu entstandene Referenz wird nicht erneut ausgewertet. Nicht zugeordnete Textteile bleiben erhalten; ein vollständiges HTML-Dokument wird dabei weder geparst noch validiert.

Erkannte Referenzen prüft he 1.2.0 im strikten Modus. So werden etwa �, €, Surrogatwerte und � abgewiesen. Auch beim Kodieren sind bestimmte HTML-Zeichen und ungepaarte Surrogate unzulässig. Nach einem Fehler gibt es weder eine Teilausgabe noch ein kopierbares altes Ergebnis.

Fragen zu Dezimalreferenzen

Bleiben Leerraum und Zeilenenden unverändert?

Leerzeichen werden nicht abgeschnitten und Unicode wird nicht normalisiert. Ein Leerzeichen wird zu  , LF zu 
. Das Eingabefeld wandelt tatsächliche CR- und CRLF-Zeilenenden allerdings in LF um. Der Kern kann CR als 
 kodieren, doch die strikte Dekodierung weist 
 zurück. Eine verlustfreie Rückumwandlung aller Eingaben wird deshalb nicht zugesichert.

Warum verändert Dekodieren manche Texte nicht?

Ohne unterstützte Dezimalreferenz bleibt die Eingabe normalerweise unverändert; eine leere Eingabe ergibt eine leere Ausgabe. Tatsächliche ungepaarte Surrogate im Ergebnis werden dennoch zurückgewiesen. Die wörtliche Zeichenfolge \uD800 ist kein solches Zeichen und bleibt erhalten. Erkannte Referenzen können ebenfalls an der strikten Prüfung scheitern. Der alte Name Native / Unicode steht nicht für einen allgemeinen Unicode-Escape-Decoder.

Zuletzt verwendet: