Wandeln Sie Text in die ältere Schreibweise %uXXXX um oder lesen Sie die darin dargestellten Zeichen. Der Kodierer lässt Zeichen bis U+00FF stehen und ersetzt höhere UTF-16-Einheiten. Eine Umkodierung von UTF-8-Bytes nach GBK findet nicht statt.
Läuft lokal in deinem BrowserMit %u4F60 lassen sich etwa chinesische Zeichen als Textfolge darstellen. Der Dekodierer liest außerdem %XX-Werte und hexadezimale Referenzen mit abschließendem Semikolon. Die Berechnung läuft im Browser; der Eingabetext wird dabei nicht in Konvertierungsanfragen gesendet.
%E4%F6%FC ergibt äöü. Jeder %XX-Wert wird einzeln auf U+00XX abgebildet. Die UTF-8-URL-Folge %E4%BD%A0 wird hier daher nicht zu 你; dafür ist der URL-Dekodierer vorgesehen.
Beim Kodieren bleiben Leerraum, Satzzeichen, Prozentzeichen und alle weiteren Zeichen bis U+00FF unverändert. Das ist weder die vollständige escape()-Funktion noch eine Ausgabe von JavaScript-Escapes mit Rückstrich.
A wird zu A und 😀 zu 😀. Diese mit Semikolon abgeschlossenen Referenzen werden direkt in Unicode-Skalarwerte umgewandelt. Surrogatwerte und Werte oberhalb U+10FFFF sind unzulässig. Ein vollständiges HTML-Dokument wird nicht geparst.
Die ältere Form 你 ohne Semikolon bleibt unterstützt und ergibt 你 als eine UTF-16-Einheit. Sie benötigt ein kleines x und genau vier Hexadezimalziffern, auf die keine weitere Hexadezimalziffer folgt. Andere nicht abgeschlossene Referenzen bleiben wörtlich stehen.
%25u0041 ergibt den wörtlichen Text %u0041. Dezimale und benannte Referenzen, \u0041, %U0041 sowie unvollständige Prozent-Escapes bleiben stehen. %u und die ältere vierstellige Referenz erhalten UTF-16-Einheiten einschließlich ungepaarter Surrogate; eine Prüfung der gesamten Zeichenfolge auf gültiges Unicode erfolgt nicht.
Nein. Ein bereits wörtlich vorhandenes %41 bleibt beim Kodieren stehen und wird beim Dekodieren zu A. Tatsächliche CR- und CRLF-Zeilenenden normalisiert das Eingabefeld außerdem zu LF. Eine Unicode-Normalisierung findet nicht statt.
Die frühere Bezeichnung passte nicht zum Programmcode. Die beibehaltene Funktion verarbeitet Text-Escapes und keine Datei-Bytes zwischen Zeichencodierungen. HTML-Tags in der Ausgabe bleiben sichtbarer Text und werden nicht ausgeführt.