100 % lokal — Ihre Daten verlassen nie Ihren Browser

HTML-Entitäten zu Text — ein Snippet lesen

HTML-Entitäten zurück in Zeichen dekodieren. Numerische Referenzen werden alle unterstützt, ein unbekannter Name bleibt sichtbar — Sie sehen, was dastand.

Sofort Privat Null Cookies

HTML Entities-Eingabe

Text-Ausgabe

Was dieses Werkzeug tut

Jede Referenz &…; wird zu dem Zeichen, das sie benennt.

  • Numerisch, dezimal — é ergibt é.
  • Numerisch, hexadezimal — é und é ergeben beide é.
  • Benannt — &,  , —, é und rund sechzig weitere gängige Namen.

Ein Zeichen außerhalb der Basisebene kommt als eine Referenz an und geht als ein Zeichen heraus: 😀 und 😀 ergeben beide das Emoji.

Ein unbekannter Name bleibt sichtbar

♥ kommt als ♥ heraus.

HTML5 definiert mehr als zweitausend Namen. Dieses Werkzeug trägt die, denen man wirklich begegnet, und lässt den Rest unangetastet — weil die Alternativen schlechter sind. Eine nicht erkannte Referenz zu löschen verliert stillschweigend Daten. Sie zu raten erfindet ein Zeichen, das nie da war. Sie sichtbar zu lassen sagt Ihnen genau, was nicht behandelt wurde, und die numerische Form funktioniert immer.

Die Dekodierung läuft einmal

&amp;lt; ergibt &lt;, nicht <.

Das ist die richtige Antwort, keine Einschränkung. &amp;lt; ist das, was ein Kodierer erzeugt, wenn der Quelltext die vier literalen Zeichen &lt; waren — ein einziger Durchgang liefert also genau diesen Quelltext. Den Dekodierer erneut laufen zu lassen würde escaptes Markup in lebendiges Markup verwandeln, genau das Versagen, das Escapen verhindern soll.

Das Semikolon ist Pflicht

&amp x bleibt unangetastet. Browser dekodieren manche Referenzen tatsächlich ohne Abschluss, aus Kompatibilität mit Dokumenten aus den Neunzigern, aber welche, hängt vom Parser und vom Kontext ab. Das Semikolon zu verlangen heißt, dass das Ergebnis nicht davon abhängt, wen Sie fragen.

Referenzen, die kein Zeichen benennen

Drei Fälle kommen unverändert zurück, statt dekodiert zu werden:

  • &#0; — ein NUL hat in HTML keine zulässige Darstellung, und eines zu erzeugen schneidet eine C-Zeichenkette ab, zerstört ein SQL-Insert und beschädigt alles, was das Ergebnis liest;
  • &#xD800; bis &#xDFFF; — Surrogathälften sind keine Zeichen, nur ein Kodierungsartefakt;
  • alles über &#1114111; — jenseits der Obergrenze von Unicode.

Sie sehen die Referenz, die Sie eingegeben haben — das ehrliche Signal, dass sie nichts benannt hat.

Datenschutz ab Werk

Alles läuft lokal in deinem Browser mit JavaScript. Deine Daten werden nie hochgeladen, wodurch das Tool auch für sensible Inhalte sicher ist und offline funktioniert.

Häufige Fragen

Warum steht &hearts; noch in meiner Ausgabe?
Weil der Name nicht in der Liste steht, die dieses Werkzeug dekodiert, und ihn sichtbar zu lassen ist besser als ihn zu löschen oder zu raten. HTML5 definiert über zweitausend Namen; die gängigen sind abgedeckt, alles andere bleibt genau so, wie Sie es eingegeben haben. Die numerische Form `&#9829;` wird dekodiert.
Warum wurde &amp;lt; nur zu &lt; und nicht zu <?
Weil die Dekodierung einmal läuft. `&amp;lt;` ist das, was ein Kodierer aus dem literalen Text `&lt;` erzeugt — ein Durchgang gibt also genau diesen Text zurück, und das ist die richtige Antwort. Zweimal zu dekodieren würde escaptes Markup in lebendiges Markup verwandeln, genau den Fehler, den Escapen verhindern soll.
Warum blieb &#0; unverändert?
Weil es kein Zeichen zu erzeugen gibt. Ein NUL hat in einem HTML-Dokument keine zulässige Darstellung, und es auszugeben würde eine C-Zeichenkette abschneiden, ein SQL-Insert zerstören und alles beschädigen, was das Ergebnis liest. Dasselbe gilt für eine Surrogathälfte und für alles über U+10FFFF: die Referenz kommt unverändert zurück.

Ähnliche Konverter