Cosa fa questo strumento
Il testo viene codificato in UTF-8, e ogni byte risultante viene scritto in esadecimale minuscolo, separato da uno spazio.
La separazione è voluta: una sequenza continua di cifre si legge male e si conta peggio, e guardare l’esadecimale serve proprio a contare.
Byte, non caratteri
È la parte che sorprende, ed è ciò che rende utile lo strumento:
hi → 68 69 2 byte, 2 caratteri
café → 63 61 66 c3 a9 5 byte, 4 caratteri
😀 → f0 9f 98 80 4 byte, 1 carattere
UTF-8 ha larghezza variabile. Una lettera ASCII costa un byte, una latina accentata due, gran parte dei caratteri CJK tre, un’emoji quattro. Se una colonna di database, un campo di protocollo o un formato di file ti limita a n byte, è questo il conto che conta — non quello che mostra il tuo editor.
Cosa rende visibile
Tutto ciò che non si disegna. Un a capo finale vale 0a. Un fine riga di Windows vale 0d 0a, due byte dove ne aspettavi uno. Uno spazio unificatore, identico all’occhio, vale c2 a0. Una marca dell’ordine dei byte in testa al file vale ef bb bf.
Ognuno di questi ha già rotto da qualche parte un confronto, un parser o un’importazione, e nessuno è visibile in un campo di testo.
Rileggere l’esadecimale
Il verso inverso accetta spazi e maiuscole: puoi incollare l’output di un dump esadecimale, di un debugger o di un log senza ripulirlo prima.
Un numero dispari di cifre dà errore anziché una congettura: un byte sono due cifre, e non c’è modo di sapere quale estremo manchi.
Privato per progettazione
Tutto viene eseguito localmente nel browser con JavaScript. I tuoi dati non vengono mai caricati, quindi lo strumento è sicuro per contenuti sensibili e funziona anche offline.