• [^] # Re: Résumé

    Posté par (site web personnel, Mastodon) . En réponse au lien Unicode misconceptions. Évalué à 6. Dernière modification le 27 février 2024 à 20:02.

    Où est le « bloat » qui augmenterait ? On parle d'un jeu de caractères, de trois encodages et de quelques algorithmes plutôt simples, pas d'un logiciel qui grossirait en nombre de lignes de code. Ce n'est pas rajouter des caractères qui va augmenter la complexité de quoi que ce soit, tout au plus cela grossira un peu les tables (remarque : le rythme des ajouts s'est considérablement ralenti ces dernières années, cf. https://www.unicode.org/versions/stats/chart_charbyyear.html, et puis franchement, la taille des tables n'est généralement pas un facteur critique, sauf sans doute dans l'embarqué où chaque Ko compte). Quant aux catégories de caractères et aux algorithmes, ils sont essentiellement stables à ma connaissance.

    Unicode est ce qui permet au monde d'avoir essentiellement un unique jeu de caractères, et, avec certes des poches de résistance de latin1 et UTF-16, un unique encodage, UTF-8, ce qui est incontestablement mille fois plus simple que la prolifération d'encodages qui avait cours avant, parce que non, on ne peut pas se contenter de l'ASCII quant il y a 65 millions de Français, 1,4 milliards de Chinois, etc. Donc l'argument de simplification joue fortement en faveur d'Unicode, à mon sens.

    Quand à la complexité des algorithmes comme la normalisation etc. (qui du reste est toute relative, les algorithmes sont assez simples, le problème est plutôt que les programmeurs ne savent pas s'en servir) : comme Einstein ne l'a probablement pas dit, « Everything should be made as simple as possible — but no simpler ».