Ce que fait cet outil
Cinq caractères changent le sens du HTML : ils reçoivent un nom.
| Caractère | Sortie |
|---|---|
& | & |
< | < |
> | > |
" | " |
' | ' |
Tout ce qui dépasse l’ASCII imprimable devient une référence numérique décimale : é donne é, € donne €.
Numériques plutôt que nommées
é ressort en é, pas en é, et c’est délibéré.
Une entité nommée doit être définie par le type de document. HTML en définit quelques milliers ; XML en définit exactement cinq. Collez é dans un fichier XML, un flux Atom ou un document XHTML servi comme du XML : l’analyseur signale une entité non définie. é est compris par tous.
Les caractères invisibles deviennent visibles
Une espace insécable devient  . C’est souvent tout l’intérêt de l’outil : un U+00A0 collé depuis Word ressemble exactement à une espace dans votre éditeur et ne se comporte pas du tout comme elle, et l’encodage est la manière de le repérer.
Tabulation et saut de ligne restent bruts. Ils sont légitimes dans du texte HTML, et les transformer en références rendrait la source moins lisible sans rien apporter.
L’apostrophe
' devient ' plutôt que '. ' est défini en XML et en HTML5, mais pas en HTML 4 : un document dans ce mode affiche les sept caractères au lieu du guillemet. La forme numérique n’a pas ce trou.
Une référence par caractère, pas par unité
Un emoji ressort en 😀, une seule référence. Les caractères hors du plan multilingue de base sont stockés sur deux unités en interne, et un échappeur naïf en émet deux références cassées. Celui-ci parcourt les points de code.
Confidentiel par conception
Tout s’exécute localement dans votre navigateur en JavaScript. Vos données ne sont jamais envoyées sur un serveur, ce qui rend l’outil sûr pour des contenus sensibles, et il fonctionne hors ligne.