* Il est OBLIGATOIRE d'utiliser la norme ISO 8859-15 Latin 9, pour l'encodage sur un octet des caractères. Règle 0001 Interopérabilité technique
* Il est OBLIGATOIRE d'utiliser UNICODE v4.1.0, pour l'encodage multi-octet des caractères. Règle 0002 Interopérabilité technique
Autrement dit : pour des caractères latins, il faut utiliser soit ISO 8859-15, soit UNICODE (qui est un surensemble d'UTF-8).
Bref, UTF-8 est ok. Formellement: sauf si on l'utilise pour encoder de l'ASCII pur (dans ce cas, UTF-8 n'utilise qu'un seul octet) ; mais dans ce cas il n'y a pas de différence d'encodage avec Latin9 donc on peut dire que le document est encodé en ISO 8859-15 autant qu'il est UNICODE/UTF-8, et on reste dans les prescriptions.
Si on voulais chipoter un peu, on pourrai plutôt noter que la spécification ne précise pas OBLIGATOIRE ... "pour les documents destiné à l'échange", ou n'indique pas que ASCII est OK, mais je pense que c'est implicite (vu que le document parle d'intéropérabilité).
Car de nombreux logiciels, libres ou pas, (en particulier les logiciels serveurs etc.) utilisent ASCII pour le traitement de certaines chaines, en interne (eg. envoi/reception d'une requette HTTP, negociation SMTP ou DNS, fichiers de confs, fichiers de code source pour certains languages interprétés, traitement des arguments en ligne de commande ...). Certes, générer du ASCII c'est aussi générer du ISO 8859-15 (qui est un surrensemble d'ASCII), mais en retour ces logiciels ne peuvent accépter n'importe quelle chaine ISO 8859-15 (et ne sont donc pas pleinement compatibles avec la spec).
[^] # Re: Codage des caractères ?
Posté par herodiade . En réponse à la dépêche Appel à commentaires sur le référentiel général d'interopérabilité. Évalué à 10.
* Il est OBLIGATOIRE d'utiliser la norme ISO 8859-15 Latin 9, pour l'encodage sur un octet des caractères. Règle 0001 Interopérabilité technique
* Il est OBLIGATOIRE d'utiliser UNICODE v4.1.0, pour l'encodage multi-octet des caractères. Règle 0002 Interopérabilité technique
Autrement dit : pour des caractères latins, il faut utiliser soit ISO 8859-15, soit UNICODE (qui est un surensemble d'UTF-8).
Bref, UTF-8 est ok. Formellement: sauf si on l'utilise pour encoder de l'ASCII pur (dans ce cas, UTF-8 n'utilise qu'un seul octet) ; mais dans ce cas il n'y a pas de différence d'encodage avec Latin9 donc on peut dire que le document est encodé en ISO 8859-15 autant qu'il est UNICODE/UTF-8, et on reste dans les prescriptions.
Si on voulais chipoter un peu, on pourrai plutôt noter que la spécification ne précise pas OBLIGATOIRE ... "pour les documents destiné à l'échange", ou n'indique pas que ASCII est OK, mais je pense que c'est implicite (vu que le document parle d'intéropérabilité).
Car de nombreux logiciels, libres ou pas, (en particulier les logiciels serveurs etc.) utilisent ASCII pour le traitement de certaines chaines, en interne (eg. envoi/reception d'une requette HTTP, negociation SMTP ou DNS, fichiers de confs, fichiers de code source pour certains languages interprétés, traitement des arguments en ligne de commande ...). Certes, générer du ASCII c'est aussi générer du ISO 8859-15 (qui est un surrensemble d'ASCII), mais en retour ces logiciels ne peuvent accépter n'importe quelle chaine ISO 8859-15 (et ne sont donc pas pleinement compatibles avec la spec).