Was dieses Tool macht
Der Text wird als UTF-8 kodiert, und jedes entstehende Byte wird in kleingeschriebenem Hexadezimal ausgegeben, durch ein Leerzeichen getrennt.
Die Trennung ist Absicht: Eine Ziffernkette liest sich schlecht und zählt sich noch schlechter, und Hex anzusehen dient genau dem Zählen.
Bytes, keine Zeichen
Das ist der Teil, der überrascht, und genau er macht das Tool nützlich:
hi → 68 69 2 Bytes, 2 Zeichen
café → 63 61 66 c3 a9 5 Bytes, 4 Zeichen
😀 → f0 9f 98 80 4 Bytes, 1 Zeichen
UTF-8 ist variabel breit. Ein ASCII-Buchstabe kostet ein Byte, ein akzentuierter lateinischer zwei, die meisten CJK-Zeichen drei, ein Emoji vier. Begrenzt Sie eine Datenbankspalte, ein Protokollfeld oder ein Dateiformat auf n Bytes, dann zählt diese Zahl — nicht die, die Ihr Editor anzeigt.
Was es sichtbar macht
Alles, was sich nicht darstellt. Ein abschließender Zeilenumbruch ist 0a. Ein Windows-Zeilenende ist 0d 0a, zwei Bytes, wo Sie eines erwarteten. Ein geschütztes Leerzeichen, dem Auge gleich, ist c2 a0. Eine Byte-Reihenfolge-Marke am Dateianfang ist ef bb bf.
Jedes davon hat irgendwo schon einen Vergleich, einen Parser oder einen Import zerlegt, und keines ist in einem Textfeld zu sehen.
Hex zurücklesen
Die Gegenrichtung nimmt Leerzeichen und Großbuchstaben an: Sie können die Ausgabe eines Hexdumps, eines Debuggers oder eines Logs einfügen, ohne sie vorher zu säubern.
Eine ungerade Ziffernzahl ist ein Fehler und keine Vermutung: Ein Byte sind zwei Ziffern, und es lässt sich nicht wissen, welches Ende fehlt.
Datenschutz ab Werk
Alles läuft lokal in deinem Browser mit JavaScript. Deine Daten werden nie hochgeladen, wodurch das Tool auch für sensible Inhalte sicher ist und offline funktioniert.