En fait l'unicode ça veut dire pas mal de chose...
- en valeur scalaire, ça va de 0 à 0x10FFFF et ça peut coder tout ce qu'on veut (même les alphabets de tolkien, et il reste encore beaucoup de place)
- ensuite pour le coder, on a l'utf-8, l'utf-16 ou l'utf-32, avec les deux premiers où un caractère peu être codé sur plusieurs mots.
- et en interne ça va dépendre des systèmes : unix à des wchar_t sur 4 octets, windows sur 2, et gtk va faire de l'utf-8. Chacun à ses défauts et ses avantages.
Sinon, je crois qu'effectivement, il y avait une époque où l'unicode ne dépassait pas 0xFFFF et ça posait donc problème pour certaines langues, mais maintenant qu'on est passé à 32 bits, on ne devrait plus avoir de problème pendant un moment... à moins de découvrir l'atlantide ou je ne sais quelle civilisation perdue et ses 234x10^56 caractères...
[^] # Re: Locales et charset
Posté par calandoa . En réponse au journal Locales et charset. Évalué à 1.
- en valeur scalaire, ça va de 0 à 0x10FFFF et ça peut coder tout ce qu'on veut (même les alphabets de tolkien, et il reste encore beaucoup de place)
- ensuite pour le coder, on a l'utf-8, l'utf-16 ou l'utf-32, avec les deux premiers où un caractère peu être codé sur plusieurs mots.
- et en interne ça va dépendre des systèmes : unix à des wchar_t sur 4 octets, windows sur 2, et gtk va faire de l'utf-8. Chacun à ses défauts et ses avantages.
Sinon, je crois qu'effectivement, il y avait une époque où l'unicode ne dépassait pas 0xFFFF et ça posait donc problème pour certaines langues, mais maintenant qu'on est passé à 32 bits, on ne devrait plus avoir de problème pendant un moment... à moins de découvrir l'atlantide ou je ne sais quelle civilisation perdue et ses 234x10^56 caractères...