Quand une page est stockée dans le serveur en format Unicode UTF-8, mais affichée dans le navigateur par erreur en mode de caractère uni-octet, abusivement appelé ASCII, ie, en charset=windows-1252, ce caractère Unicode UTF-8 prend deux places.
Essayez le caractère é Unicode: il est doublé en é
Il était une fois dans l'Ouest de la Chine... il faisait froid en hiver.
Au contraire si votre page est stockée dans le serveur web en format ANSI/ASCII, mais affichée dans le navigateur du client par erreur en mode de caractère multi-octet UTF-8, appelé Unicode, en mode Unicode UTF-8, ie, en charset=UTF-8, ce caractère ASCII devient plus mince encore pour devenir un diamant point d'interrogation ou carré vide, comme s'il n'est pas assez costaud pour occuper même une seule place dans le monde Unicode qui est multi-octet.
En rÚgle générale, quand votre fichier est en codage plus petit, plus maigre que le codage du navigateur à l'affichage, le diamant point d'interrogation ou carré vide � apparaît.
Essayez le caractère é ASCII: il est réduit en diamant point d'interrogation ou carré vide �.
Il �tait une fois dans l'Ouest de la Chine... il faisait froid en hiver.
Il est utile de préciser que tous les caractÚres ASCII du code 0 à 127 gardent toujours les mêmes codes sans changement quelque soit le codage des caractÚres, ASCII, GBK, Unicode...
Tous les caractÚres ASCII étendus du code 0 à 255 (2**8=256, uni-octet, mono-byte) peuvent être stockés soit dans un fichier ASCII, soit en format Unicode UTF-8. Le contraire n'est pas vrai, les caractÚres multi-octet (multi-byte) avec un code supérieur ou égal à 256, qui ne peuvent être conservés que dans un fichier Unicode comme UTF-8, ou bien dans un format spécifique (code page pays) tel le GBK pour les idéogrammes chinois.
Sur le web, un caractÚre Unicode peut en outre s'exprimer en code entité HTML, ainsi stocké dans un fichier du codage ASCII. Par exemple, l'idéogramme è¯ signifiant Langue, peut être stocké en mode ASCII par la chaîne 语, composée uniquement des ampersand &, diÚse #, suivi par des chiffres du numéro décimal de ce caractÚre en Unicode, et terminé par un point-virgule ;.
äžåœåºå¯¹äººç±»äœåºèŸå€§ç莡ç®ïŒ
La Chine doit faire une contribution relativement grande à l'Humanité !
ÙÙتعÙ٠عÙ٠اÙصÙ٠تÙدÙ٠اسÙا٠ات اÙؚر ÙÙؚ؎رÙØ©!
ÐОÑай ЎПлжеМ ÑЎелаÑÑ Ð±ÐŸÐ»ÑÑОй вклаЎ в ÑелПвеÑеÑÑвП!
ÎίΜα Ξα ÏÏÎÏει Μα ÏÏ ÎŒÎ²Î¬Î»ÎµÎ¹ ÏεÏιÏÏÏÏεÏο ÏÏηΜ αΜΞÏÏÏÏÏηÏα!
äžåœã¯äººé¡ã«å€§ããªè²¢ç®ãããŠãã ããïŒ
×ס×× ×ש תך××× ××××× ××× ×ש×ת!
à€à¥à€š à€®à€Ÿà€šà€µ à€à€Ÿà€€à€¿ à€à¥ à€²à€¿à€ à€à€ à€¬à€¡à€Œà€Ÿ à€¯à¥à€à€Šà€Ÿà€š à€à€°à€šà€Ÿ à€à€Ÿà€¹à€¿à€!
àžàžµàžàžàž§àž£àžàž°à¹àž«à¹àž¡àžµàžªà¹àž§àžàž£à¹àž§àž¡àž¡àž²àžàžàž¶à¹àžà¹àžàž·à¹àžàž¡àžàžžàž©àž¢àžàž²àžàžŽ!
ÚÛ٠ؚاÛد سÙÙ ØšÛØŽØªØ±Û ØšÙ Ø§Ùسا٠را!
China shall make a relatively great contribution to the Man Kind!
Cette page est stockée dans le disque dur en format UTF-8 sans BOM. Mais je vous propose de l'afficher en différents codages. Elle peut devenir illisible si le codage diffÚre trop. Il faut revenir en UTF-8 si vous avez mal à la tête. Testez vous-même sur votre navigateur en cliquant sur les liens suivants:
[Auto Detection] (auto) | Arabic (ISO-8859-6) | Arabic (Windows-1256) | ASCII Western European (ISO-8859-1) | ASCII Western European (Windows-1252) | Baltic (ISO-8859-4) | Baltic (Windows-1257) | Central European (Windows-1250) | Chinese Simplified (GB18030) | Chinese Simplified (GB2312) | Chinese Simplified (GBK) | Chinese Simplified (HZ) | Chinese Traditional (Big5) | Cyrillic (ISO-8859-5) | Cyrillic (KOI8-R) | Cyrillic (KOI8-U) | Cyrillic (Windows-1251) | Greek (Windows-1253) | Hebrew (Windows-1255) | Hebrew (ISO-8859-8-l) | Celtic (ISO-8859-14) | Central European (ISO-8859-2) | Estonian (ISO-8859-13) | Greek (ISO-8859-7) | Hebrew (ISO-8859-8) | Japanese (EUC-JP) | Japanese (ISO-2022-JP) | Japanese (Shift_JIS) | Korean (EUC-KR) | Latin 9 (ISO-8859-15) | Nordic (ISO-8859-10) | Roumain (ISO-8859-16) | South European (ISO-8859-3) | Thai (TIS-620) | Turkish (ISO-8859-9) | Turkish (Windows-1254) | Unicode (UTF-16LE) | Unicode (UTF-8) | Vietnamese (Windows-1258).