• # mon explication

    Posté par (site web personnel) . En réponse au journal Notepad et réaction louche. Évalué à 10.

    A mon avis l'explication est relativement simple :
    Les fichiers textes peuvent être interprêtés différement selon l'encodage dans lequel on suppose qu'ils aient été écrits. Hors la plupart du temps rien n'indique l'encodage utilisé lors de la rédaction du texte, l'éditeur de texte doit donc essayer un encodage "au pif". Après il y a des petites astuces pour (tenter de) reconnaître l'encodage utilisé, essentiellement en se basant sur une signature ou quelques règles statistiques.
    Notepad doit avoir une petite règle pour essayer de deviner l'encodage d'un fichier texte, et comme par hasard cette séquence de caractère reproduit cette situation : par défaut notepad enregistre en ANSI, lorsque l'on ouvre à nouveau le fichier, celui-ci est interprété comme étant en Unicode (facile à vérifier, allez dans Enregistrez-sous et regarder l'encodage proposé).

    Après leur algo ne semble pas parfait, mais aucun ne l'ai vraiment, et on peut tromper tous les éditeurs de texte de cette manière (qui n'a jamais ouvert un fichier texte avec des accents bizzare ?).