Une référence HTML est une notation source qu’un analyseur résout en caractères. EntityCodec traite une saisie bornée sans analyser un document complet.

Trois formes visibles

Une référence peut être &, & ou &. Les trois représentent une esperluette avec une lisibilité différente.

L’encodage peut avoir des couches

Le texte © devient d’abord © puis © au second passage. EntityCodec ne décode qu’une couche.

Vérifiez la destination exacte

L’encodage des références change la représentation du texte, pas son niveau de confiance. Gardez la sortie en texte jusqu’à ce que la destination applique l’échappement ou le nettoyage propre à son contexte. Comparez le résultat complet après collage. Pour un contrôle reproductible, conservez un exemple littéral avec sa forme encodée attendue, exécutez deux fois le même profil et comparez chaque esperluette, point-virgule, point Unicode, espace et retour à la ligne. Testez ensuite la liaison texte de destination avec des caractères représentatifs inoffensifs. Si le système normalise, décode plusieurs fois ou rend la valeur, documentez ce comportement ultérieur séparément car il se situe hors d’EntityCodec.