> Juste pour chipoter: la norme Unicode definit plusieurs jeux de caracteres, par exemple UTF-8, UTF-16, UTF-32, comportant chacun ses avantages et inconvenients suivant le contexte. Ce n'est donc pas la fin des charsets.
Non, c'est un codage d'UNICODE. UNICODE dit que '€' a pour valeur 345 et UTF-8 le code cette valeur avec 0x024485 (NB : c'est peut-être n'impore quoi comme un exemple). Il y a des fonctions assez simple pour passer de UNICODE à UTF-8 (ou 16, etc) et vice versa. Ces fonctions marquent quelque soit la version d'UNICODE utilisé.
UTF-8, etc ne définit pas de caractère. C'est UNICODE qui le fait.
[^] # Re: Unicode definit plusieurs charsets...
Posté par IsNotGood . En réponse au journal Explosion d'UNICODE sur le web. Évalué à 10.
Non, c'est un codage d'UNICODE. UNICODE dit que '€' a pour valeur 345 et UTF-8 le code cette valeur avec 0x024485 (NB : c'est peut-être n'impore quoi comme un exemple). Il y a des fonctions assez simple pour passer de UNICODE à UTF-8 (ou 16, etc) et vice versa. Ces fonctions marquent quelque soit la version d'UNICODE utilisé.
UTF-8, etc ne définit pas de caractère. C'est UNICODE qui le fait.