Encodage d'entités HTML

Collez du HTML ou du texte ci-dessous et cliquez sur Encoder pour échapper les caractères spéciaux en entités HTML. Tout le traitement se fait localement dans votre navigateur.

Copié !

Qu'est-ce que l'encodage d'entités HTML ?

L'encodage d'entités HTML convertit les caractères spéciaux en leurs équivalents d'entités HTML pour éviter qu'ils soient interprétés comme du balisage HTML. Par exemple :

  • <&lt;
  • >&gt;
  • &&amp;
  • "&quot;
  • '&#39;

Cela prévient les attaques XSS et garantit que le texte s'affiche correctement dans les documents HTML.

C'est le réglage de portée qui compte. N'encoder que ce qui casse le HTML garde le texte lisible et convient à tout ce qu'une personne rééditera. Tout encoder au-delà de l'ASCII produit une sortie qui survit à une chaîne bloquée sur un jeu de caractères mono-octet, au prix d'un fichier bien plus gros. L'option des caractères invisibles mérite un passage dès qu'un titre semble faux sans raison : une espace insécable ou un liant de largeur nulle arrivé par copier-coller apparaît comme une référence nommée que vous voyez enfin.

Le balisage vous résiste ?

Des entités échappées, des encodages abîmés et un contenu qui s'affiche d'une façon dans le CMS et d'une autre sur la page signifient en général que quelque chose devine dans la chaîne. Nous construisons les interfaces et le chemin de publication derrière elles, pour que le visiteur voie ce que vous avez écrit.

Parlons de votre site

Questions fréquentes

Qu'est-ce qu'une entité HTML ?
C'est une façon d'écrire un caractère pour qu'un navigateur le lise comme du texte et non comme du balisage. &amp; représente une esperluette et &lt; un signe inférieur, ce qui empêche un chevron égaré de passer pour le début d'une balise.
Quels caractères faut-il vraiment encoder ?
Dans du texte ordinaire, seuls l'esperluette et le signe inférieur sont strictement nécessaires, et le signe supérieur par convention. Dans un attribut s'ajoute le guillemet qui le ferme. Le reste est facultatif, d'où le réglage par défaut qui encode exactement cet ensemble et laisse le reste lisible.
Références nommées ou numériques ?
Les nommées se lisent mieux et parlent à qui édite le fichier. Les numériques fonctionnent pour tous les caractères, y compris les nombreux qui n'ont pas de nom, et ne dépendent jamais de la connaissance d'un nom par l'analyseur. L'hexadécimal est la forme que vous verrez dans les spécifications et dans la plupart des sorties générées.
Pourquoi encoder tout ce qui dépasse l'ASCII ?
Parce qu'un maillon de la chaîne n'est fiable pour rien d'autre : un vieil export, un gabarit de courriel, un système qui déclare un jeu de caractères et en envoie un autre. Encoder au-delà de l'ASCII fait survivre le fichier, au prix de la taille, et reste le mauvais choix pour tout ce qu'une personne rééditera.
Que trouve l'option des caractères invisibles ?
Espaces insécables, liants de largeur nulle, traits d'union conditionnels et les autres caractères qui arrivent par copier-coller puis cassent une mise en page sans raison visible. Activée, elle les affiche sous forme de références visibles, et c'est en général le chemin le plus court vers celui qui pose problème.