• [^] # Re: Comment identifier un encodage?

    Posté par . En réponse au journal Comment identifier un encodage?. Évalué à 1.

    Je suppose effectivement qu'il s'agisse d'un texte littéraire (une ou plusieures langues)
    ou d'une base de données contenant des noms, adresses, téléphones, email, etc...
    Mais le cas d'un texte formatté ou par exemple d'un source en C ne posent
    pas de problèmes car tous les signes, mot clés, ponctuations tordues sont en
    général codés avec les caractères inférieurs à 128, càd ascii, et les différences
    entre charsets ne concernent que les caractères entre 128 et 255 (à part l'utf,
    reconnaissable facilement par d'autres manières et qqs charsets préhistoriques :),
    ça n'est donc que sur ces caractères (et peut être leur contexte, à priori du texte
    "littéraire") que va se faire la reconnaissance. Celle ci ne sera pas parfaite (cf plus
    haut) mais tant qu'elle marche dans la majorité des cas...

    Quant à l'unicode, c'est effectivement la solution pour exporter un fichier, mais
    pas pour l'importer, ou tout au moins pas tant que les autres charsets ne seront
    pas morts et enterrés (et pour l'instant c'est pas gagné...)