Au commencement etait ASCII: "les caracteres romain sans accents suffisent a tout le monde, ils n'ont qu'a ecrire en anglais". C'etait du 7bits. Avec les trucs de ponctuation, et tout ca.
Et puis il restait un bit de libre dans un octet, on pouvait ajouter 128 caracteres
les europeens et ceux qui ont des langues avec quelques dizaines de caracteres en plus (comme les israeliens) en ont profite pour rajouter leurs caracteres. Mais y'avait pas la place pour tout le monde, donc chacun s'est octroye les 128 caracteres de son cote et on ne pouvait pas lire une chaine ecrite sur un ordi francais dans un ordi grec. Pour les asiatiques c'etait encore plus chaud, vu qu'il y a des milliers de caracteres, il fallait en code certains sur 2 octets.
C'etait pas grave quand les ordinateurs etaient deconnectes, mais avec Internet et tout ca c'est devenu un peu plus genant. Les logiciel d'email et les browsers doivent gerer quasiment autant de tables d'encodage que de langues. En plus pour melanger les langues, genre faire un dico hebreux-grec, c'est une autre pair de manche.
Et la, est arrive (il y a plus de 10 ans...) Unicode ! C'est vieux, mais vraiment implemente depuis peu, genre 2-3 ans. Avec unicode, un seul encodage pour toutes les langues du monde, c'est plus simple pour les developpeurs et pour les utilisateurs.
[^] # Re: Matroska c'est bien mais... (numéro 4)
Posté par Erwan . En réponse au journal Matroska c'est bien mais... (numéro 4). Évalué à 6.
Et puis il restait un bit de libre dans un octet, on pouvait ajouter 128 caracteres
les europeens et ceux qui ont des langues avec quelques dizaines de caracteres en plus (comme les israeliens) en ont profite pour rajouter leurs caracteres. Mais y'avait pas la place pour tout le monde, donc chacun s'est octroye les 128 caracteres de son cote et on ne pouvait pas lire une chaine ecrite sur un ordi francais dans un ordi grec. Pour les asiatiques c'etait encore plus chaud, vu qu'il y a des milliers de caracteres, il fallait en code certains sur 2 octets.
C'etait pas grave quand les ordinateurs etaient deconnectes, mais avec Internet et tout ca c'est devenu un peu plus genant. Les logiciel d'email et les browsers doivent gerer quasiment autant de tables d'encodage que de langues. En plus pour melanger les langues, genre faire un dico hebreux-grec, c'est une autre pair de manche.
Et la, est arrive (il y a plus de 10 ans...) Unicode ! C'est vieux, mais vraiment implemente depuis peu, genre 2-3 ans. Avec unicode, un seul encodage pour toutes les langues du monde, c'est plus simple pour les developpeurs et pour les utilisateurs.