• [^] # Re: Codage des caractères ?

    Posté par (site web personnel) . En réponse à la dépêche Appel à commentaires sur le référentiel général d'interopérabilité. Évalué à 10.

    UTF-8 est un codage Multi-octet, basé sur un octet.

    ne pas confondre :
    - ISO xxx sur un octet
    - UTF-8 Multi-octet mais basé sur un octet (un logiciel prévu pour un octet peut le traiter sans probleme, juste l'affichage qui est bizarre)
    - Unicode codés sur 4 octets (Windows utilise UTF-16, sur 2 octets)

    On considère donc UTF-8 comme un "charset" sur un octet, au meme titre que ISO xxx, mais on le traite a l'afficahge comme du 4 octets.

    donc maintenant, la spécification n'est pas claire, car ne fait pas cette difference : comment stocker Unicode? UTF-8? UTF-16? UTF-32? Big Endian ou Little Endian?

    Donc faudrait préciser Unicode, par contre je comprend pour avoir de l'inter-operabilité maximum on utilise ISO Latin 9.
    (en fait, je l'ai fait maintenant :) )