Cet exemple combine ASCII, une valeur BMP accentuĂ©e prĂ©composĂ©e et un emoji supplĂ©mentaire. Il teste plusieurs largeurs UTF-8 et prouve que scalaires, UTF-16 et octets rĂ©pondent Ă  des questions diffĂ©rentes. Le mĂȘme cas sert d’entrĂ©e par dĂ©faut et de test automatisĂ©, empĂȘchant l’article et l’outil de diverger.

Chargez le preset de largeur mixte

Ouvrez l’inspecteur et choisissez A · Ă© · 😀 ou collez les trois valeurs sans sĂ©parateur. La premiĂšre ligne doit ĂȘtre U+0041, dĂ©cimal 65, UTF-8 41 et UTF-16 0041. La seconde vaut U+00E9, dĂ©cimal 233, UTF-8 C3 A9 et UTF-16 00E9. Aucune rĂšgle locale ne change ces valeurs.

Vérifiez la ligne supplémentaire

La troisiĂšme ligne est U+1F600, dĂ©cimal 128512. UTF-8 vaut F0 9F 98 80 et UTF-16 D83D DE00. L’échappement utilise \u{1F600}, nommant directement le scalaire plutĂŽt que deux substituts. Le rĂ©sumĂ© doit donner trois scalaires, quatre unitĂ©s UTF-16 et sept octets UTF-8.

Décodez la séquence U+ copiée

Copiez U+0041 U+00E9 U+1F600, passez au mode points-vers-texte et lancez. Le texte doit ĂȘtre exactement AĂ©đŸ˜€ et les lignes identiques. Ajouter virgules ou notation 0x doit Ă©chouer sans rĂ©paration. L’aller-retour prouve grammaire et encodage, pas un rendu identique dans tous les systĂšmes.