100 % local — seus dados nunca saem do seu navegador

Texto para hexadecimal — veja o caractere invisível

Mostre um texto como bytes UTF-8 em hexadecimal, separados por espaços. A contagem de bytes costuma surpreender, e o byte a mais costuma ser a resposta.

Instantâneo Privado Zero cookies

Entrada Text

Saída Hex

O que esta ferramenta faz

O texto é codificado em UTF-8 e cada byte resultante é escrito em hexadecimal minúsculo, separado por um espaço.

A separação é deliberada: uma sequência corrida de dígitos se lê mal e se conta pior, e olhar hexadecimal serve justamente para contar.

Bytes, não caracteres

Esta é a parte que surpreende, e é o que torna a ferramenta útil:

hi      →  68 69              2 bytes,  2 caracteres
café    →  63 61 66 c3 a9     5 bytes,  4 caracteres
😀      →  f0 9f 98 80        4 bytes,  1 caractere

O UTF-8 tem largura variável. Uma letra ASCII custa um byte, uma latina acentuada dois, a maioria dos caracteres CJK três, um emoji quatro. Se uma coluna de banco, um campo de protocolo ou um formato de arquivo limita você a n bytes, é esta contagem que vale — não a que o seu editor mostra.

O que ela revela

Tudo o que não se desenha. Uma quebra de linha final é 0a. Um fim de linha do Windows é 0d 0a, dois bytes onde você esperava um. Um espaço inquebrável, idêntico a olho nu, é c2 a0. Uma marca de ordem de bytes no início do arquivo é ef bb bf.

Cada um deles já quebrou em algum lugar uma comparação, um parser ou uma importação, e nenhum aparece num campo de texto.

Ler hexadecimal de volta

O sentido inverso aceita espaços e maiúsculas: dá para colar a saída de um dump hexadecimal, de um depurador ou de um log sem limpar antes.

Um número ímpar de dígitos vira erro em vez de palpite: um byte são dois dígitos, e não há como saber qual ponta falta.

Privado por padrão

Tudo é executado localmente no seu navegador com JavaScript. Os seus dados nunca são enviados para um servidor, o que torna a ferramenta segura para conteúdo sensível e funciona offline.

Perguntas frequentes

Por que minha palavra de 4 letras mostra 5 bytes?
Porque o UTF-8 tem largura variável. Uma letra ASCII ocupa um byte, uma acentuada dois, a maioria dos caracteres CJK três, e um emoji quatro. A ferramenta mostra bytes, daí a diferença para a contagem de caracteres.
Posso colar hexadecimal com espaços ou maiúsculas?
Sim, os dois. Espaços são ignorados e `4A` lê igual a `4a`. O que é recusado é um número ímpar de dígitos: um byte são dois, e adivinhar qual ponta falta seria pior do que avisar.
Por que isso ajuda a depurar?
Porque torna visível o que não é. Uma quebra de linha final, um espaço inquebrável, uma marca de ordem de bytes, um fim de linha do Windows: nada disso aparece num campo de texto, e tudo aparece aqui.

Conversores relacionados