UTF-8 est un codage Multi-octet, basé sur un octet.
ne pas confondre :
- ISO xxx sur un octet
- UTF-8 Multi-octet mais basé sur un octet (un logiciel prévu pour un octet peut le traiter sans probleme, juste l'affichage qui est bizarre)
- Unicode codés sur 4 octets (Windows utilise UTF-16, sur 2 octets)
On considère donc UTF-8 comme un "charset" sur un octet, au meme titre que ISO xxx, mais on le traite a l'afficahge comme du 4 octets.
donc maintenant, la spécification n'est pas claire, car ne fait pas cette difference : comment stocker Unicode? UTF-8? UTF-16? UTF-32? Big Endian ou Little Endian?
Donc faudrait préciser Unicode, par contre je comprend pour avoir de l'inter-operabilité maximum on utilise ISO Latin 9.
(en fait, je l'ai fait maintenant :) )
[^] # Re: Codage des caractères ?
Posté par Zenitram (site web personnel) . En réponse à la dépêche Appel à commentaires sur le référentiel général d'interopérabilité. Évalué à 10.
ne pas confondre :
- ISO xxx sur un octet
- UTF-8 Multi-octet mais basé sur un octet (un logiciel prévu pour un octet peut le traiter sans probleme, juste l'affichage qui est bizarre)
- Unicode codés sur 4 octets (Windows utilise UTF-16, sur 2 octets)
On considère donc UTF-8 comme un "charset" sur un octet, au meme titre que ISO xxx, mais on le traite a l'afficahge comme du 4 octets.
donc maintenant, la spécification n'est pas claire, car ne fait pas cette difference : comment stocker Unicode? UTF-8? UTF-16? UTF-32? Big Endian ou Little Endian?
Donc faudrait préciser Unicode, par contre je comprend pour avoir de l'inter-operabilité maximum on utilise ISO Latin 9.
(en fait, je l'ai fait maintenant :) )