Je le maintiens, désolé. Il FAUT savoir l'encodage pour en faire quoi que ce soit.
Personne ne prétend le contraire. Si je reprends le document que j’ai déjà cité (le RFC 2046), il est bien précisé :
A critical parameter that may be specified in the Content-Type field for "text/plain" data is the character set.
(C’est moi qui souligne.)
You can no longer stick your head in the sand and pretend that "plain" text is ASCII.
Encore une fois, personne n’a prétendu ça (en tout cas pas moi). Le « plain text » est une séquence de caractères. L’encodage desdits caractères ne fait pas partie de la définition (d’où précisément le fait qu’il soit « critical » de le préciser à côté). Une séquence de caractères encodés en UTF-8 est du « plain text » au même titre qu’une séquence de caractères encodés en Latin-1.
There Is No Such Thing As Plain Text.
Je ne suis définitivement pas d’accord avec cette formulation. Il est dommage qu’elle soit tellement mise en évidence dans ce texte, parce que ce n’est pas le message que l’auteur veut faire passer. Le vrai message serait plutôt quelque chose du genre « Not Everyone Uses ASCII » ou « A Sequence Of Characters Is Not A Sequence Of Bytes ». Là je serais d’accord.
C'est comme tu disais "tiens, voilà un fichier image". Ok. Quel format ? JPEG, PNG, autre ?
C'est un poil important, quand même.
Une image reste une matrice de pixels,1 indépendemment du format de ceux-ci, tout comme du texte brut reste une séquence de caractères. Manipuler l’image nécessite de connaître son format, évidemment, mais on ne peut pas dire « There Is No Such Thing As Images », simplement parce qu’il existe plusieurs façons de représenter des matrices de pixels.
1Bon, hors le cas des images vectorielles, je préfère le préciser avant que quelqu’un ne rebondisse là-dessus.
[^] # Re: Mon avis personnel
Posté par gouttegd . En réponse au journal Debian adopte systemd comme init par défaut. Évalué à 2.
Personne ne prétend le contraire. Si je reprends le document que j’ai déjà cité (le RFC 2046), il est bien précisé :
(C’est moi qui souligne.)
Encore une fois, personne n’a prétendu ça (en tout cas pas moi). Le « plain text » est une séquence de caractères. L’encodage desdits caractères ne fait pas partie de la définition (d’où précisément le fait qu’il soit « critical » de le préciser à côté). Une séquence de caractères encodés en UTF-8 est du « plain text » au même titre qu’une séquence de caractères encodés en Latin-1.
Je ne suis définitivement pas d’accord avec cette formulation. Il est dommage qu’elle soit tellement mise en évidence dans ce texte, parce que ce n’est pas le message que l’auteur veut faire passer. Le vrai message serait plutôt quelque chose du genre « Not Everyone Uses ASCII » ou « A Sequence Of Characters Is Not A Sequence Of Bytes ». Là je serais d’accord.
Une image reste une matrice de pixels,1 indépendemment du format de ceux-ci, tout comme du texte brut reste une séquence de caractères. Manipuler l’image nécessite de connaître son format, évidemment, mais on ne peut pas dire « There Is No Such Thing As Images », simplement parce qu’il existe plusieurs façons de représenter des matrices de pixels.
1Bon, hors le cas des images vectorielles, je préfère le préciser avant que quelqu’un ne rebondisse là-dessus.