J'ai découvert au passage que "é" est le code Unicode 233 en iso et 233 en UTF-8 ! (si c'est affiché \xC3\xA9, c'est parce UTF-8 ajoute des bits de "contrôle" (je vais pas entrer dans les détails ici)).
Tu n'as manifestement pas compris l'encodage UTF-8. Le "é" c'est bien le caractère Unicode n°00E9 (soit 233 en décimal, c'est volontaire, les 256 premiers caractères d'Unicode reprennent l'ISO-8859-1), et il se code C3 A9 en UTF-8, point final. (Mais d'où sors-tu ton second 233 ?!)
Pour information, les caractères Unicode de 0000 à 007F se codent sur un octet en UTF-8, les caractères de 0080 à 07FF se codent sur deux octets, les caractères de 0800 à FFFF se codent sur trois octets. (Et ainsi de suite pour les autres caractères, on peut monter jusqu'à six octets de cette manière.)
[^] # Re: Support des encodages quoted printabled
Posté par Boa Treize (site web personnel) . En réponse au journal Petit outil pour changer de charset et d'encodage. Évalué à 2.
Tu n'as manifestement pas compris l'encodage UTF-8. Le "é" c'est bien le caractère Unicode n°00E9 (soit 233 en décimal, c'est volontaire, les 256 premiers caractères d'Unicode reprennent l'ISO-8859-1), et il se code C3 A9 en UTF-8, point final. (Mais d'où sors-tu ton second 233 ?!)
Pour information, les caractères Unicode de 0000 à 007F se codent sur un octet en UTF-8, les caractères de 0080 à 07FF se codent sur deux octets, les caractères de 0800 à FFFF se codent sur trois octets. (Et ainsi de suite pour les autres caractères, on peut monter jusqu'à six octets de cette manière.)