• [^] # Re: bah le seul probleme c'est le C++

    Posté par (site web personnel) . En réponse au message Exploration système de fichier en UTF8 & accès MySQL ?. Évalué à 4.

    Non, c'est pas si simple car pour toutes sortes d'opérations, il faut des fonctions spécifiquement écrites pour considérer l'UTF8 et la "richesse" de l'unicode :
    - compter le nombre de caractères (différent du nombre d'octets)
    - parcourir caractère par caractère ("lettre par lettre", fussent-elles accentuées en dehors de latin-1 ou de langues non-latines, etc.)
    - savoir s'il s'agit d'une lettre (pouvant composer un mot ou faire partie d'une phrase) ou plutôt un chiffre ou un symbole.
    - découper les mots en considérant toutes sortes de caractères pouvant les séparer, et non plus seulement l'espace, la tabulation, etc.
    - obtenir la version majuscule ou minuscule d'un mot
    - comparer deux chaînes sans considérer la casse des lettres (dans différentes langue, pas uniquement latin-1)
    - comparer sans considérer l'accentuation (même si cela peut porter à confusion parfois)
    - etc.

    Pour tout cela, il existe des séries de fonctions. Mais j'aimerais que l'on me guide vers la librairie qu'il vaut mieux utiliser pour cela, portable, pérenne, bien suivie (l'unicode évolue chaque année), et bien entendu compatible GPL ;) Ou encore, quelle librairie est actuellement utilisée dans dans le logiciels libres les plus en vogues, etc.